Hive 사용자 문서
Hive 사용자 문서 (Hive User)
Apache Hive 사용자를 위한 문서 모음의 시작점이에요. Hive의 기본 개념, 데이터 모델, 쿼리 언어, 저장 포맷, 접속 방법 등을 다루는 사용자 문서로 안내합니다.
출처: 문서
본문
이 문서는 Hive 사용자 가이드로 가는 인덱스 페이지입니다.
Hive란?
Apache Hive는 대용량 데이터 집합을 SQL로 분석할 수 있게 해 주는 데이터 웨어하우스 소프트웨어입니다. 하둡(HDFS 등) 위에 저장된 데이터를 HiveQL이라는 SQL 유사 언어로 조회·집계할 수 있습니다.
주요 사용자 문서 영역
- 기본 개념: Hive 아키텍처, 데이터 모델(테이블·파티션·버킷), 메타스토어
- 쿼리 언어 (HiveQL / Language Manual): DDL, DML, 함수, 집계, 조인, 서브쿼리 등
- 저장 포맷: 텍스트, Parquet, ORC 등과 압축
- 접속과 사용: Hive CLI, Beeline, HiveServer2 클라이언트
- 데이터 불러오기/내보내기: LOAD, INSERT, 외부 테이블 등
시작 예시
-- 데이터베이스 생성
CREATE DATABASE analytics;
-- 테이블 생성
CREATE TABLE events (
id INT,
name STRING
) PARTITIONED BY (dt STRING);
-- 데이터 조회
SELECT name, count(*) FROM events
WHERE dt = '2026-09-24' GROUP BY name;
참고: 각 주제별 상세 내용은 원문 문서의 개별 페이지를 참고하세요.
더 알아보기 (Learn more)
- Hive를 처음 접한다면 데이터 모델과 HiveQL 언어 매뉴얼부터 시작하는 것을 추천해요. 그다음 Beeline 접속과 저장 포맷을 함께 배우면 실제 워크로드에 적용하기 쉽습니다.