벤치마크
벤치마크 (Benchmarks - benchmarks)
성능 가이드의 여러 권장사항은 실제 마이크로벤치마크로 뒷받침돼요. 이 페이지에서는 그 벤치마크에 쓰인 데이터셋과 주의사항, 그리고 결과를 해석할 때 유의점을 정리해 드릴게요.
개요 (Overview)
성능 가이드의 여러 권장사항을 뒷받침하기 위해 마이크로벤치마크를 사용해요. 이 벤치마크에는 TPC-H 벤치마크의 데이터셋과 LDBC Social Network Benchmark의 BI 워크로드 데이터셋을 사용해요.
데이터셋 (Datasets)
- 일부 벤치마크는 LDBC BI SF300 데이터셋의 Comment 테이블을 사용해요. (20 GB
.tar.zst아카이브,.csv.gz파일로 압축 해제하면 21 GB) - 다른 벤치마크는 같은 테이블의
creationDate컬럼을 사용해요. (4 GB.parquet파일)
벤치마크에 사용된 TPC 데이터셋은 DuckDB의 tpch 확장으로 생성했어요.
벤치마크에 대한 참고 (A Note on Benchmarks)
공정한 벤치마크를 실행하는 것은 어려워요, 특히 시스템 간 비교를 할 때 말이죠. DuckDB에서 벤치마크를 실행할 때는 최신 버전(가급적 preview 빌드)을 사용하세요. 벤치마크 결과가 의심스러우면 언제든지 [email protected]로 연락해도 돼요.
벤치마크에 대한 고지 (Disclaimer on Benchmarks)
이 가이드에 제시된 벤치마크 결과는 공식 TPC 또는 LDBC 벤치마크 결과가 아니에요. 대신 TPC-H와 LDBC BI 벤치마크 프레임워크가 제공하는 데이터셋과 일부 쿼리만 사용하며, 업데이트 같은 워크로드의 다른 부분은 생략했어요.