Parquet 파일 쿼리하기
Parquet 파일 쿼리하기 (Querying Parquet Files)
Parquet 파일에 직접 쿼리를 날리고 싶다면, 쿼리의 FROM 절에 read_parquet 함수를 사용하면 돼요. DuckDB가 내부적으로 최적화까지 해 주니까 성능 걱정 없이 쓸 수 있죠.
Parquet 파일에 직접 쿼리하기
Parquet 파일에 직접 쿼리를 실행하려면 쿼리의 FROM 절에 read_parquet 함수를 사용해요.
SELECT * FROM read_parquet('input.parquet');
Parquet 파일은 병렬(parallel)로 처리돼요. 필터(filter)는 Parquet 스캔으로 자동 push down되고, 관련된 컬럼만 자동으로 읽힙니다. 즉 필요 없는 데이터를 읽지 않도록 DuckDB가 알아서 최적화해 주는 거죠.
더 자세한 내용은 블로그 포스트 “Querying Parquet with Precision using DuckDB”를 참고하세요.