varSampStable
varSampStable
데이터 집합의 표본 분산(sample variance)을 계산하는 집계 함수예요. varSamp과 달리 수치적으로 안정한 알고리즘을 사용해서 더 느리지만 계산 오차가 더 작아요.
출처: 문서
본문
varSampStable은 데이터 집합의 표본 분산 을 계산해요. varSamp과 달리 수치적으로 안정한 알고리즘을 사용해요. 더 느리게 동작하지만 계산 오차가 더 작아요. 표본 분산은 varSamp과 동일한 공식으로 계산돼요:
$$\frac{\Sigma{(x - \bar{x})^2}}{n-1}$$
여기서:
x는 데이터 집합의 각 데이터 포인트x̄는 데이터 집합의 산술 평균n은 데이터 집합의 데이터 포인트 수
구문 (Syntax)
varSampStable(x)
인자 (Arguments)
반환 값 (Returned value)
입력 데이터 집합의 표본 분산. Float64
예제 (Examples)
수치적으로 안정한 표본 분산 계산하기
쿼리:
DROP TABLE IF EXISTS test_data;
CREATE TABLE test_data
(
x Float64
)
ENGINE = Memory;
INSERT INTO test_data VALUES (10.5), (12.3), (9.8), (11.2), (10.7);
SELECT round(varSampStable(x),3) AS var_samp_stable FROM test_data;
응답:
┌─var_samp_stable─┐
│ 0.865 │
└─────────────────┘
더 알아보기 (Learn more)
varSamp— 기본 표본 분산 계산