HCatalog
HCatalog
HCatalog은 Hadoop용 테이블·저장소 관리 레이어로, 서로 다른 데이터 처리 도구(Pig, MapReduce)를 쓰는 사용자들이 그리드의 데이터를 더 쉽게 읽고 쓸 수 있게 해줘요. HCatalog 매뉴얼의 시작점 문서입니다.
출처: 문서
본문
HCatalog은 Hadoop용 테이블·저장소 관리 레이어로, 서로 다른 데이터 처리 도구 — Pig, MapReduce — 를 쓰는 사용자들이 그리드의 데이터를 더 쉽게 읽고 쓸 수 있게 해줍니다.
이 문서는 HCatalog 매뉴얼입니다.
- Using HCatalog
- Installation from Tarball
- HCatalog Configuration Properties
- Load and Store Interfaces
- Input and Output Interfaces
- Reader and Writer Interfaces
- Command Line Interface
- Storage Formats
- Dynamic Partitioning
- Notification
- Storage Based Authorization
옛 HCatalog 위키 페이지에는 추가 사용자 문서, HBase 통합에 대한 더 많은 정보, 기여자를 위한 리소스 등 많은 다른 문서가 있습니다.
HCatalog의 REST API인 WebHCat(구 Templeton)에 대한 정보는 WebHCat Manual를 참고하세요.
내비게이션 링크(Navigation Links) 다음: Using HCatalog
더 알아보기 (Learn more)
HCatalog은 Hadoop 생태계에서 공통 테이블·저장소 추상화를 제공해요. Hive뿐 아니라 Pig, MapReduce 도구들이 같은 메타데이터를 공유해 데이터를 쉽게 읽고 쓸 수 있습니다. HCatalog REST API(=WebHCat)를 다루는 문서도 함께 보면 좋아요.