SYSTEM$GET_CLASSIFICATION_RESULT

SYSTEM$GET_CLASSIFICATION_RESULT

지정된 객체의 분류(classification) 결과를 반환해요.

Enterprise Edition 기능: 이 기능은 Enterprise Edition 이상이 필요해요. 업그레이드를 문의하려면 Snowflake 지원에 연락하세요.

출처: Snowflake SYSTEM$GET_CLASSIFICATION_RESULT 함수 문서

본문

구문 (Syntax)

SELECT SYSTEM$GET_CLASSIFICATION_RESULT( '<object_name>' )

인자 (Arguments)

  • object_name — 분류할 열을 포함하는 테이블, 외부 테이블, 뷰, 또는 구체화된 뷰의 이름이에요. 현재 세션에서 데이터베이스와 스키마를 사용 중이 아니라면 이름은 정규화되어야 해요. 이름은 데이터베이스에 저장된 대로 정확히 지정해야 해요. 이름에 특수 문자, 대문자, 또는 공백이 포함되면 이름을 먼저 큰따옴표로 묶은 다음 작은따옴표로 묶어야 해요.

반환 값 (Returns)

다음 형식의 JSON 객체를 반환해요. 예:

{
  "classification_profile_config": {
    "classification_profile_name": "db1.sch.sensitive_data_detection_profile"
  },
  "classification_result": {
    "col1_name": {
      "alternates": [],
      "recommendation": {
        "confidence": "HIGH",
        "coverage": 1,
        "details": [],
        "privacy_category": "QUASI_IDENTIFIER",
        "semantic_category": "DATE_OF_BIRTH",
        "tags": [
          {
            "tag_applied": true,
            "tag_name": "snowflake.core.semantic_category",
            "tag_value": "DATE_OF_BIRTH"
          },
          {
            "tag_applied": true,
            "tag_name": "snowflake.core.privacy_category",
            "tag_value": "QUASI_IDENTIFIER"
          }
        ]
      },
      "valid_value_ratio": 1
    }
  }
}

가능한 필드 (Possible Fields):

  • classification_profile_config — 자동 분류가 구성된 경우 분류 결과를 생성하는 데 사용된 구성 프로필의 정규화된 이름을 포함해요.
  • classification_result — 분류된 각 열에 대한 세부 정보를 제공해요.
  • object_path_results — 열에 민감한 필드가 있는 반정형 데이터가 포함된 경우 object_path_results 키는 네이티브 또는 사용자 지정 의미 범주로 분류된 필드를 나열해요. 자세한 내용은 JSON 열의 분류 결과 보기를 참고하세요.
  • alternates — 권장 태그 외에 고려할 각 태그와 값에 대한 정보를 제공해요.
  • recommendation — 분류 프로세스를 기반으로 기본 선택으로서 각 태그와 값에 대한 정보를 제공해요.

이 값들은 alternates와 recommendation 모두에 나타날 수 있어요.

  • classifier_name — 분류된 열에 태그를 지정하는 데 사용된 사용자 지정 분류 인스턴스의 정규화된 이름이에요. 이 필드는 열에 설정할 태그의 소스로 사용자 지정 분류 인스턴스를 사용할 때만 나타나요.
  • confidence — 다음 값 중 하나를 제공해요: HIGH, MEDIUM, LOW. 이 값은 열 샘플링 과정과 열 데이터가 Snowflake의 데이터 분류 방식과 얼마나 일치하는지에 기반한 Snowflake의 상대적 신뢰도를 나타내요.
  • coverage — 특정 범주에 대한 규칙과 일치하는 샘플링된 셀 값의 백분율을 제공해요.
  • details — 지역(geography)별 분류와 관련된 필드와 값을 제공해요. semantic_category 필드에는 로케일에 대한 의미 하위 범주가 포함돼요.
  • privacy_category — 개인정보 보호 범주를 제공해요. 가능한 값은 IDENTIFIER, QUASI-IDENTIFIER, SENSITIVE예요.
  • semantic_category — 의미 범주를 제공해요. 네이티브 의미 범주 목록은 민감한 데이터 분류의 네이티브 의미 범주를 참고하세요. 값이 MULTIPLE이면 반정형 데이터에서 민감한 데이터가 발견된 거예요. 분류 중 발견된 네이티브 및 사용자 지정 의미 범주에 대한 자세한 구분은 결과 객체의 object_path_results 필드를 검사하세요. 자세한 내용은 JSON 열의 분류 결과 보기를 참고하세요.
  • tags — 분류 과정의 결과로 열에 적용된 태그에 대한 정보를 제공해요.
  • valid_value_ratio — 샘플 크기에서 유효한 값의 비율을 제공해요.
    • 구조화 데이터의 경우 NULL, 빈 문자열, 256자를 초과하는 문자열은 잘못된 값이에요.
    • 반정형 데이터의 경우 NULL과 빈 문자열이 잘못된 값이에요.

예제 (Examples)

테이블의 민감한 데이터 분류 결과를 반환해요:

SELECT SYSTEM$GET_CLASSIFICATION_RESULT('hr.tables.empl_info');

더 알아보기