sparkbar
sparkbar
x 값과 그 값들의 반복 빈도 y에 대해 구간 [min_x, max_x] 안에서 빈도 히스토그램을 그려요. 같은 버킷에 속하는 모든 x의 반복은 평균 처리되므로 데이터는 사전 집계되어야 해요. 음수 반복은 무시해요.
출처: 문서
본문
sparkbar 함수는 x 값들과 그 값들의 반복 빈도 y에 대해 구간 [min_x, max_x] 안에서 빈도 히스토그램을 그려요. v21.11.0에 도입되었어요.
같은 버킷에 속하는 모든 x의 반복은 평균 처리되므로, 데이터는 사전에 집계되어야 해요. 음수 반복은 무시해요.
구간을 지정하지 않으면 최솟값 x를 구간의 시작으로, 최댓값 x를 구간의 끝으로 사용해요. 그 외에는 구간 밖의 값은 무시돼요.
구문 (Syntax)
sparkbar(buckets[, min_x, max_x])(x, y)
별칭(Aliases): sparkBar
매개변수 (Parameters)
buckets— 세그먼트(구간)의 개수예요. (U)Int* 타입이에요.min_x— 선택 사항이에요. 구간의 시작이에요. (U)Int* 또는 Float* 또는 Decimal 타입이에요.max_x— 선택 사항이에요. 구간의 끝이에요. (U)Int* 또는 Float* 또는 Decimal 타입이에요.
인자 (Arguments)
x— 값이 담긴 필드예요. const String 타입이에요.y— 값의 빈도가 담긴 필드예요. const String 타입이에요.
반환 값 (Returned value)
빈도 히스토그램을 반환해요.
- String 타입이에요.
예시 (Examples)
구간을 지정하지 않은 경우
쿼리:
CREATE TABLE spark_bar_data (`value` Int64, `event_date` Date) ENGINE = MergeTree ORDER BY event_date;
INSERT INTO spark_bar_data VALUES (1,'2020-01-01'), (3,'2020-01-02'), (4,'2020-01-02'), (-3,'2020-01-02'), (5,'2020-01-03'), (2,'2020-01-04'), (3,'2020-01-05'), (7,'2020-01-06'), (6,'2020-01-07'), (8,'2020-01-08'), (2,'2020-01-11');
SELECT sparkbar(9)(event_date, cnt) FROM (SELECT sum(value) AS cnt, event_date FROM spark_bar_data GROUP BY event_date);
응답:
┌─sparkbar(9)(event_date, cnt)─┐
│ ▂▅▂▃▆█ ▂ │
└──────────────────────────────┘
구간을 지정한 경우
쿼리:
SELECT sparkbar(9, toDate('2020-01-01'), toDate('2020-01-10'))(event_date, cnt) FROM (SELECT sum(value) AS cnt, event_date FROM spark_bar_data GROUP BY event_date);
응답:
┌─sparkbar(9, toDate('2020-01-01'), toDate('2020-01-10'))(event_date, cnt)─┐
│ ▂▅▂▃▇▆█ │
└──────────────────────────────────────────────────────────────────────────┘