Stats bucket 집계
Stats bucket 집계
stats_bucket 집계는 이전 집계의 버킷들에 대한 다양한 통계(count, min, max, avg, sum)를 반환하는 형제(sibling) 집계예요. 숫자 지표와 함께 쓰이며, 형제 집계는 반드시 다중 버킷(multi-bucket) 집계여야 해요.
출처: 문서
본문
stats_bucket 집계는 이전 집계의 버킷들에 대한 다양한 통계(count, min, max, avg, sum)를 반환하는 형제(sibling) 집계입니다.
지정한 지표는 숫자여야 하며, 형제로 사용하는 집계는 다중 버킷(multi-bucket) 집계여야 합니다.
파라미터
stats_bucket 집계는 다음 파라미터를 받습니다.
| 파라미터 | 필수/선택 | 데이터 타입 | 설명 |
|---|---|---|---|
buckets_path |
필수 | String | 집계할 집계 버킷들의 경로입니다. Buckets path를 참고하세요. |
gap_policy |
선택 | String | 누락된 데이터에 적용할 정책입니다. 유효한 값은 skip과 insert_zeros이며 기본값은 skip입니다. Data gaps를 참고하세요. |
format |
선택 | String | DecimalFormat 서식 문자열입니다. 집계의 <stat>_as_string 속성에 서식이 적용된 출력을 반환합니다. |
예제
다음 예제는 OpenSearch Dashboards e-commerce 샘플 데이터를 사용해 한 달 간격의 날짜 히스토그램을 만듭니다. sum 서브 집계가 매달 모든 bytes의 합계를 계산합니다. 마지막으로 stats_bucket 집계가 이 합계들에서 count, avg, sum, min, max 통계를 반환합니다.
GET opensearch_dashboards_sample_data_logs/_search
{
"size": 0,
"aggs": {
"visits_per_month": {
"date_histogram": {
"field": "@timestamp",
"interval": "month"
},
"aggs": {
"sum_of_bytes": {
"sum": {
"field": "bytes"
}
}
}
},
"stats_monthly_bytes": {
"stats_bucket": {
"buckets_path": "visits_per_month>sum_of_bytes"
}
}
}
}
예제 응답
집계는 버킷들에 대한 다섯 가지 기본 통계를 모두 반환합니다.
{
"took": 4,
"timed_out": false,
"_shards": {
"total": 1,
"successful": 1,
"skipped": 0,
"failed": 0
},
"hits": {
"total": {
"value": 10000,
"relation": "gte"
},
"max_score": null,
"hits": []
},
"aggregations": {
"visits_per_month": {
"buckets": [
{
"key_as_string": "2025-03-01T00:00:00.000Z",
"key": 1740787200000,
"doc_count": 480,
"sum_of_bytes": {
"value": 2804103
}
},
{
"key_as_string": "2025-04-01T00:00:00.000Z",
"key": 1743465600000,
"doc_count": 6849,
"sum_of_bytes": {
"value": 39103067
}
},
{
"key_as_string": "2025-05-01T00:00:00.000Z",
"key": 1746057600000,
"doc_count": 6745,
"sum_of_bytes": {
"value": 37818519
}
}
]
},
"stats_monthly_bytes": {
"count": 3,
"min": 2804103,
"max": 39103067,
"avg": 26575229.666666668,
"sum": 79725689
}
}
}