Parquet 파일 쿼리하기

Parquet 파일 쿼리하기 (Querying Parquet Files)

Parquet 파일에 직접 쿼리를 날리고 싶다면, 쿼리의 FROM 절에 read_parquet 함수를 사용하면 돼요. DuckDB가 내부적으로 최적화까지 해 주니까 성능 걱정 없이 쓸 수 있죠.

출처: DuckDB 공식 문서 — query-parquet

Parquet 파일에 직접 쿼리하기

Parquet 파일에 직접 쿼리를 실행하려면 쿼리의 FROM 절에 read_parquet 함수를 사용해요.

SELECT * FROM read_parquet('input.parquet');

Parquet 파일은 병렬(parallel)로 처리돼요. 필터(filter)는 Parquet 스캔으로 자동 push down되고, 관련된 컬럼만 자동으로 읽힙니다. 즉 필요 없는 데이터를 읽지 않도록 DuckDB가 알아서 최적화해 주는 거죠.

더 자세한 내용은 블로그 포스트 “Querying Parquet with Precision using DuckDB”를 참고하세요.

더 알아보기 (Learn more)