최대 버킷 집계
최대 버킷 집계 (Maximum bucket aggregation)
max_bucket 집계는 이전 집계의 각 버킷에서 메트릭의 최댓값을 계산하는 형제(sibling) 집계예요.
지정된 메트릭은 숫자여야 하고, 형제 집계는 다중 버킷(multi-bucket) 집계여야 해요.
출처: 문서
본문
파라미터
max_bucket 집계는 다음과 같은 파라미터를 받아요.
| 파라미터 | 필수/선택 | 데이터 타입 | 설명 |
|---|---|---|---|
buckets_path |
필수 | String | 집계할 버킷의 경로예요. 버킷 경로(Buckets path) 문서를 참고하세요. |
gap_policy |
선택 | String | 누락 데이터에 적용할 정책이에요. 유효한 값은 skip과 insert_zeros예요. 기본값은 skip이에요. 데이터 공백(Data gaps) 문서를 참고하세요. |
format |
선택 | String | DecimalFormat 형식 문자열이에요. 집계의 value_as_string 속성에 형식화된 출력을 반환해요. |
예제
다음 예제는 OpenSearch Dashboards e-커머스 샘플 데이터에서 한 달 간격의 날짜 히스토그램을 생성해요. sum 하위 집계가 매월 바이트의 합계를 계산해요. 마지막으로 max_bucket 집계가 최댓값—이 버킷들 중 가장 큰 값—을 찾아요:
POST opensearch_dashboards_sample_data_logs/_search
{
"size": 0,
"aggs": {
"visits_per_month": {
"date_histogram": {
"field": "@timestamp",
"interval": "month"
},
"aggs": {
"sum_of_bytes": {
"sum": {
"field": "bytes"
}
}
}
},
"max_monthly_bytes": {
"max_bucket": {
"buckets_path": "visits_per_month>sum_of_bytes"
}
}
}
}
예제 응답
max_bucket 집계는 여러 버킷에 걸쳐 지정된 메트릭의 최댓값을 반환해요. 이 예제에서는 visits_per_month 내부의 sum_of_bytes 메트릭에서 월별 최대 바이트 수를 계산해요. value 필드는 모든 버킷에서 발견된 최댓값을 보여줘요. keys 배열에는 이 최댓값이 관측된 버킷의 키가 포함돼요. 두 개 이상의 버킷이 동일한 최댓값을 가질 수 있으므로 배열이에요. 이 경우 일치하는 모든 버킷 키가 포함돼요. 이렇게 하면 여러 시간대(또는 용어)가 동일한 최댓값을 가져도 결과가 정확함을 보장해요:
{
"took": 6,
"timed_out": false,
"_shards": {
"total": 1,
"successful": 1,
"skipped": 0,
"failed": 0
},
"hits": {
"total": {
"value": 10000,
"relation": "gte"
},
"max_score": null,
"hits": []
},
"aggregations": {
"visits_per_month": {
"buckets": [
{
"key_as_string": "2025-03-01T00:00:00.000Z",
"key": 1740787200000,
"doc_count": 480,
"sum_of_bytes": {
"value": 2804103
}
},
{
"key_as_string": "2025-04-01T00:00:00.000Z",
"key": 1743465600000,
"doc_count": 6849,
"sum_of_bytes": {
"value": 39103067
}
},
{
"key_as_string": "2025-05-01T00:00:00.000Z",
"key": 1746057600000,
"doc_count": 6745,
"sum_of_bytes": {
"value": 37818519
}
}
]
},
"max_monthly_bytes": {
"value": 39103067,
"keys": [
"2025-04-01T00:00:00.000Z"
]
}
}
}