데이터 쿼리해 보기
lakeFS 서버에는 샘플 parquet 데이터 파일이 미리 올라가 있어요. 데이터 레이크 사용자를 돕는 소프트웨어답게, lakes.parquet 파일에는 세계 각지의 호수(lake)에 대한 데이터가 담겨 있어요.
브랜치가 main으로 설정되어 있는 걸 눈치채셨을 거예요. 이는 소프트웨어 코드를 개발할 때 쓰는 Git의 main 브랜치와 개념적으로 동일해요.
다음 단계에서 브랜치 위에서 데이터를 변경해 보기 전에, 먼저 데이터를 살펴봐요.
lakes.parquet을 클릭해 보세요. 내장된 DuckDB가 파일 내용 미리보기를 보여주는 쿼리를 실행해 줘요.
출처: 문서
본문
lakeFS 서버에는 샘플 parquet 데이터 파일이 로드되어 있어요. 데이터 레이크 사용자를 돕는 소프트웨어로서 딱 어울리게도, lakes.parquet 파일에는 전 세계 호수들에 대한 데이터가 들어 있어요.
브랜치가 main으로 설정되어 있다는 걸 눈치채셨을 거예요. 이건 여러분이 소프트웨어 코드를 개발할 때 쓰는 Git의 main 브랜치와 개념적으로 똑같아요.
다음 단계에서 브랜치 위에서 데이터를 변경해 볼 테니, 그 전에 먼저 데이터를 한번 살펴봐요.
lakes.parquet을 클릭하면, 내장 DuckDB가 파일 내용 미리보기를 보여주는 쿼리를 실행하는 걸 보실 수 있어요.
이제 데이터에 나타난 상위 5개 국가를 살펴보는 쿼리를 직접 실행해 볼 거예요.
다음 SQL 문을 DuckDB 쿼리 패널에 복사해 붙여넣고 Execute를 클릭하세요.
SELECT country, COUNT(*)
FROM READ_PARQUET('lakefs://quickstart/main/lakes.parquet')
GROUP BY country
ORDER BY COUNT(*)
DESC LIMIT 5;
다음으로는 데이터를 조금 변경해 볼 거예요. 다만 개발 브랜치에서 작업해서 main 브랜치의 데이터는 그대로 유지되도록 할 거예요.
← 퀵스타트 환경 실행하기 데이터의 브랜치 만들기 →
더 알아보기 (Learn more)
공식 문서의 자세한 내용은 https://docs.lakefs.io/quickstart/query/에서 확인하실 수 있어요.