mannWhitneyUTest

mannWhitneyUTest

두 모집단의 표본에 Mann-Whitney 순위 검정을 적용하는 집계 함수예요. v21.1.0부터 도입되었어요.

출처: 문서

본문

두 모집단의 표본에 Mann-Whitney 순위 검정을 적용해요. 두 표본의 값은 모두 sample_data 컬럼에 있어요. sample_index가 0이면 그 행의 값은 첫 번째 모집단의 표본에 속하고, 그 외에는 두 번째 모집단의 표본에 속해요. 귀무 가설은 두 모집단이 확률적으로 동일하다는 것이에요. 단측 가설(one-sided hypotheses)도 검정할 수 있어요. 이 검정은 데이터가 정규 분포를 따른다고 가정하지 않아요.

구문 (Syntax)

mannWhitneyUTest[(alternative[, continuity_correction])](sample_data, sample_index)

파라미터 (Parameters)

  • alternative — 선택사항이에요. 대립 가설(Alternative hypothesis)이에요.
    • 'two-sided'(기본값): 두 모집단이 확률적으로 동일하지 않다는 것이에요.
    • 'greater': 첫 번째 표본의 값이 두 번째 표본의 값보다 확률적으로 더 크다는 것이에요.
    • 'less': 첫 번째 표본의 값이 두 번째 표본의 값보다 확률적으로 더 작다는 것이에요. String
  • continuity_correction — 선택사항이에요. 0이 아니면 p-값의 정규 근사(normal approximation)에 연속성 보정(continuity correction)을 적용해요. 기본값은 1이에요. UInt64

인자 (Arguments)

  • sample_data — 표본 데이터예요. (U)Int* 또는 Float* 또는 Decimal*
  • sample_index — 표본 인덱스예요. (U)Int*

반환 값 (Returned value)

두 요소를 가진 튜플을 반환해요: 계산된 U-통계량과 계산된 p-값. Tuple(Float64, Float64)

예시 (Examples)

Mann-Whitney U 검정 예:

CREATE TABLE mww_ttest (sample_data Float64, sample_index UInt8) ENGINE = Memory;
INSERT INTO mww_ttest VALUES (10, 0), (11, 0), (12, 0), (1, 1), (2, 1), (3, 1);

SELECT mannWhitneyUTest('greater')(sample_data, sample_index) FROM mww_ttest;

결과:

┌─mannWhitneyUTest('greater')(sample_data, sample_index)─┐
│ (9,0.04042779918502615)                                │
└────────────────────────────────────────────────────────┘

참고 (See Also)

  • Mann–Whitney U 검정
  • 확률적 순서 (Stochastic ordering)

더 알아보기 (Learn more)