meanZTest

meanZTest

두 모집단의 표본에 평균 z-검정(mean z-test)을 적용하는 집계 함수예요. v22.2.0부터 도입되었어요.

출처: 문서

본문

두 모집단의 표본에 평균 z-검정을 적용해요. 두 표본의 값은 모두 sample_data 컬럼에 있어요. sample_index가 0이면 그 행의 값은 첫 번째 모집단의 표본에 속하고, 그 외에는 두 번째 모집단의 표본에 속해요. 귀무 가설은 두 모집단의 평균이 같다는 것이에요. 정규 분포를 가정해요. 모집단의 분산이 다를 수 있으며 그 분산은 알려져 있다고 가정해요.

구문 (Syntax)

meanZTest(population_variance_x, population_variance_y, confidence_level)(sample_data, sample_index)

파라미터 (Parameters)

  • population_variance_x — 모집단 x의 분산이에요. Float*
  • population_variance_y — 모집단 y의 분산이에요. Float*
  • confidence_level — 신뢰 구간(confidence intervals)을 계산하기 위한 신뢰 수준이에요. Float*

인자 (Arguments)

  • sample_data — 표본 데이터예요. (U)Int* 또는 Float* 또는 Decimal
  • sample_index — 표본 인덱스예요. (U)Int*

반환 값 (Returned value)

네 요소를 가진 튜플을 반환해요: 계산된 z-통계량, 계산된 p-값, 계산된 신뢰 구간 하한(confidence-interval-low), 계산된 신뢰 구간 상한(confidence-interval-high). Tuple(Float64, Float64, Float64, Float64)

예시 (Examples)

평균 Z-검정 예:

CREATE TABLE mean_ztest (sample_data Float64, sample_index UInt8) ENGINE = Memory;
INSERT INTO mean_ztest VALUES (20.3, 0), (21.9, 0), (22.1, 0), (18.9, 1), (19, 1), (20.3, 1);

SELECT meanZTest(0.7, 0.45, 0.95)(sample_data, sample_index) FROM mean_ztest;

결과:

┌─meanZTest(0.7, 0.45, 0.95)(sample_data, sample_index)────────────────────────────┐
│ (3.2841296025548123,0.0010229786769086013,0.8198428246768334,3.2468238419898365) │
└──────────────────────────────────────────────────────────────────────────────────┘

더 알아보기 (Learn more)