mannWhitneyUTest
mannWhitneyUTest
두 모집단의 표본에 Mann-Whitney 순위 검정을 적용하는 집계 함수예요. v21.1.0부터 도입되었어요.
출처: 문서
본문
두 모집단의 표본에 Mann-Whitney 순위 검정을 적용해요. 두 표본의 값은 모두 sample_data 컬럼에 있어요. sample_index가 0이면 그 행의 값은 첫 번째 모집단의 표본에 속하고, 그 외에는 두 번째 모집단의 표본에 속해요. 귀무 가설은 두 모집단이 확률적으로 동일하다는 것이에요. 단측 가설(one-sided hypotheses)도 검정할 수 있어요. 이 검정은 데이터가 정규 분포를 따른다고 가정하지 않아요.
구문 (Syntax)
mannWhitneyUTest[(alternative[, continuity_correction])](sample_data, sample_index)
파라미터 (Parameters)
alternative— 선택사항이에요. 대립 가설(Alternative hypothesis)이에요.'two-sided'(기본값): 두 모집단이 확률적으로 동일하지 않다는 것이에요.'greater': 첫 번째 표본의 값이 두 번째 표본의 값보다 확률적으로 더 크다는 것이에요.'less': 첫 번째 표본의 값이 두 번째 표본의 값보다 확률적으로 더 작다는 것이에요.String
continuity_correction— 선택사항이에요. 0이 아니면 p-값의 정규 근사(normal approximation)에 연속성 보정(continuity correction)을 적용해요. 기본값은 1이에요.UInt64
인자 (Arguments)
sample_data— 표본 데이터예요.(U)Int*또는Float*또는Decimal*sample_index— 표본 인덱스예요.(U)Int*
반환 값 (Returned value)
두 요소를 가진 튜플을 반환해요: 계산된 U-통계량과 계산된 p-값. Tuple(Float64, Float64)
예시 (Examples)
Mann-Whitney U 검정 예:
CREATE TABLE mww_ttest (sample_data Float64, sample_index UInt8) ENGINE = Memory;
INSERT INTO mww_ttest VALUES (10, 0), (11, 0), (12, 0), (1, 1), (2, 1), (3, 1);
SELECT mannWhitneyUTest('greater')(sample_data, sample_index) FROM mww_ttest;
결과:
┌─mannWhitneyUTest('greater')(sample_data, sample_index)─┐
│ (9,0.04042779918502615) │
└────────────────────────────────────────────────────────┘
참고 (See Also)
- Mann–Whitney U 검정
- 확률적 순서 (Stochastic ordering)