Trino 0.57 릴리스 노트

Trino 0.57 릴리스 노트

Trino 0.57 릴리스 노트입니다. 이번 릴리스에서는 DISTINCT 집계 완전 지원, Hadoop 2.x 및 Amazon S3 지원, 여러 개선 사항이 포함돼 있어요.

출처: 문서

본문

DISTINCT 집계 (Distinct aggregations)

집계 함수의 DISTINCT 인자 한정자가 이제 완전히 지원돼요. 예:

SELECT country, count(DISTINCT city), count(DISTINCT age)
FROM users
GROUP BY country

참고: 근사 답이 허용될 때마다 approx_distinct()을 이보다 우선 사용해야 해요. 훨씬 빠르고 처리할 수 있는 고유 항목 수에 제한이 없기 때문이에요. COUNT(DISTINCT ...)는 모든 항목을 네트워크로 전송하고 각 고유 항목을 메모리에 유지해야 해요.

Hadoop 2.x

hive-hadoop2 커넥터를 사용해 Hadoop 2.x에서 Hive 데이터를 읽어요. 자세한 내용은 Trino 배포를 참고하세요.

Amazon S3

모든 Hive 커넥터가 Amazon S3에서 데이터 읽기를 지원해요. 이는 Hive 커넥터에 AWS Access Key ID와 Secret Access Key를 지정하는 두 가지 추가 카탈로그 속성이 필요해요:

hive.s3.aws-access-key=«redacted:AKIA…»
hive.s3.aws-secret-key=wJalrXUtnFEMI/K7MDENG/bPxRfiCYEXAMPLEKEY

기타 (Miscellaneous)

  • JDBC 드라이버 URL에서 카탈로그와 스키마를 지정할 수 있게 했어요.
  • JDBC 드라이버에서 더 많은 기능을 구현했어요.
  • Hive 직렬화 속성을 RecordReader로 전파해 특정 커스텀 InputFormat이 동작하도록 허용했어요.
  • 실행 엔진 성능 개선이 많아요.
  • 최적화기 성능 회귀를 수정했어요.
  • 이상한 MethodHandle 예외를 수정했어요.

더 알아보기 (Learn more)

Trino 0.57의 변경 사항을 더 자세히 확인하고 싶다면 공식 릴리스 노트를 참고해 주세요.