PARSE_DOCUMENT
PARSE_DOCUMENT (SNOWFLAKE.CORTEX)
공지
이 페이지는 하위 호환성을 위해 제공돼요. 새로운 사용 사례에서는 앞으로의 표준 표면인 AI_PARSE_DOCUMENT부터 시작하세요. 이 레거시 함수는 2026년 말까지 폐기될 예정이에요.
PARSE_DOCUMENT() 함수는 Snowflake 스테이지의 문서에서 추출한 내용을 JSON 형식 문자열로 반환해요. 이 함수는 광학 문자 인식(OCR)과 레이아웃(layout) 두 가지 추출 유형을 지원해요. 자세한 내용은 AI_PARSE_DOCUMENT로 문서 구문 분석을 참고하세요.
본문
문법
SNOWFLAKE.CORTEX.PARSE_DOCUMENT( '@<stage>', '<path>', [ <options> ] )
인자
필수: stage, path
선택: options
반환
추출된 데이터와 관련 메타데이터를 담은 JSON 객체(문자열)를 반환해요. options 인자가 반환되는 객체의 구조를 결정해요.
팁
SQL에서 출력을 사용하려면 PARSE_JSON 함수를 사용해 OBJECT 값으로 변환하세요.
'page_split' 옵션이 설정되면 출력은 다음 구조를 가져요.
참고 구문 분석이 성공하면 출력에
"pages"와"metadata"필드가 있어요."errorInformation"은 구문 분석이 실패할 때만 있어요.
'page_split'가 FALSE이거나 없으면 출력은 다음 구조를 가져요.
참고 구문 분석이 성공하면 출력에
"content"와"metadata"필드가 있어요."errorInformation"은 구문 분석이 실패할 때만 있어요.