매핑 파라미터(Mapping parameters)

매핑 파라미터(Mapping parameters)

매핑 파라미터는 인덱스 필드의 동작을 구성하는 데 사용돼요. 이 페이지는 OpenSearch가 지원하는 모든 매핑 파라미터를 한눈에 보여 주는 목록 페이지예요. 각 파라미터의 사용 사례는 해당 파라미터의 개별 페이지를 참고하세요.

출처: 문서

본문

매핑 파라미터는 인덱스 필드의 동작을 구성하는 데 사용합니다. 파라미터별 사용 사례는 해당 매핑 파라미터의 개별 페이지를 참고하세요.

다음 표는 OpenSearch 매핑 파라미터를 나열합니다.

파라미터 설명
analyzer text 필드를 인덱싱하거나 검색할 때 텍스트 분석에 사용할 분석기를 지정하며, search_analyzer로 재정의하지 않는 한 인덱스 시점과 검색 시점 분석을 모두 처리합니다.
boost 필드의 점수 기여도에 승수를 적용해 검색 쿼리 중 관련성 점수를 높이거나 낮춥니다.
coerce 인덱싱 중 OpenSearch가 값을 정규화하고 변환해 필드의 데이터 타입과 일치시키려 할지 여부를 제어합니다(예: 문자열을 숫자로 변환하거나 부동 소수점을 정수로 잘라내기).
copy_to 여러 필드의 값을 그룹 필드로 복사해 원본 _source를 수정하지 않고 단일 필드로 쿼리할 수 있게 합니다.
disable_objects 점이 있는 필드 이름이 중첩 객체 구조로 확장되는지, 아니면 리터럴 평평한 필드 식별자로 취급되는지를 제어해 지표 및 분석 워크로드에서 결정적인 수집을 보장합니다.
doc_values 인덱스 생성 시 디스크 기반의 컬럼 지향 데이터 구조를 만들어 빠른 정렬, 집계, 스크립트에서의 필드 접근을 가능하게 할지 제어합니다.
dynamic 새로 감지된 필드를 매핑에 동적으로 추가할 수 있는지 지정합니다(옵션에는 true, false, strict, strict_allow_templates, false_allow_templates가 있습니다).
eager_global_ordinals 필드에 대한 전역 서수가 언제 구축되는지 제어하며, 지연 로딩은 쿼리 실행이 아니라 인덱스 리프레시 중에 계산해 집계 및 정렬 성능을 개선합니다.
enabled OpenSearch가 필드 내용을 파싱하고 인덱싱할지 제어합니다. false로 설정하면 필드가 _source에 저장되지만 검색할 수 없습니다.
fielddata text 필드의 분석된 토큰을 정렬, 집계, 스크립팅을 위해 메모리에 로드할 수 있게 합니다. 메모리 비용이 높아 기본적으로 비활성화되어 있습니다.
fields 대체 매핑(예: 다른 데이터 타입이나 분석기)을 가진 추가 하위 필드를 정의해 같은 필드를 여러 방식으로 인덱싱해 다양한 검색 및 집계 요구를 지원합니다.
format date 필드가 인덱싱 중 받아들일 수 있는 내장 날짜 형식을 지정해 날짜 값의 올바른 파싱과 저장을 보장합니다.
ignore_above 인덱싱되는 문자열의 최대 문자 수를 제한합니다. 임계값을 초과하는 값은 인덱스 비대화를 방지하기 위해 저장되지만 인덱싱되지는 않습니다.
ignore_malformed 필드의 기대 형식과 일치하지 않는 값을 인덱싱 엔진이 무시하도록 지시해, 일부 필드에 파싱할 수 없는 데이터가 포함되어도 문서를 저장합니다.
index 필드가 역색인에 포함되는지 제어합니다. false로 설정하면 필드가 저장되지만(doc_values가 활성화되지 않는 한) 검색할 수 없습니다.
index_options text 필드에 대해 역색인에 저장되는 세부 정보 수준을 제어합니다(옵션에는 docs, freqs, positions, offsets가 있습니다). 인덱스 크기와 스코어링, 구문 매칭, 하이라이팅 기능에 영향을 줍니다.
index_phrases 필드의 텍스트를 추가 처리해 구문 토큰(bigram)을 생성할지 결정해 인덱스 크기 증가를 대가로 구문 쿼리의 성능과 정확성을 개선합니다.
index_prefixes text 필드의 용어 시작 세그먼트에 대한 추가 인덱스 항목을 생성해 자동 완성이나 검색-as-you-type 같은 접두어 쿼리의 성능을 크게 개선합니다.
meta 매핑 정의에 메타데이터를 첨부할 수 있게 하며, 인덱싱이나 검색 연산에는 영향을 주지 않고 정보 제공용 컨텍스트로 매핑과 함께 저장됩니다.
normalizer keyword 필드에 대한 맞춤형 정규화 프로세스를 정의해 토큰 필터를 사용해 전체 필드 값을 단일 토큰으로 변환하면서 _source는 그대로 유지합니다.
norms 필드에 대해 정규화 요소를 계산하고 저장할지 제어해 관련성 스코어링을 조정합니다. 저장은 인덱스 크기와 메모리 소비를 증가시킵니다.
null_value 인덱싱 중 명시적 null 값을 사전 정의된 대체 값으로 바꿔, 문서 _source를 수정하지 않고 원래 null이던 필드에 대한 쿼리와 집계를 가능하게 합니다.
position_increment_gap 인덱싱 중 다중 값 필드의 토큰 사이 위치 거리를 정의해, 여러 값에 걸쳐 검색할 때 match_phrase와 span 쿼리의 동작에 영향을 줍니다(기본값은 100 위치).
properties 객체 또는 문서 루트 안의 필드 구조와 데이터 타입을 정의해 인덱싱, 저장, 검색 동작, 데이터 검증을 제어하는 모든 매핑 정의의 핵심이 됩니다.
search_analyzer text 필드의 검색 시점에 사용할 분석기를 지정해, 인덱싱에 사용하는 분석기와 검색에 사용하는 분석기를 다르게 하여 용어 매칭을 더 잘 제어할 수 있게 합니다.
similarity 스코어링 알고리즘을 정의(옵션에는 BM25와 boolean이 있습니다)해 검색 중 text 필드의 관련성 점수가 계산되는 방식을 맞춤화합니다.
store 필드 값을 _source와 별도로 저장할지 결정하며, 검색 요청의 stored_fields 옵션을 사용해 직접 검색할 수 있게 합니다.
term_vector 맞춤형 스코어링과 하이라이팅 같은 고급 기능을 위해 인덱싱 중 text 필드의 용어 수준 정보(용어 빈도, 위치, 문자 오프셋)를 저장할지 제어합니다.

더 알아보기 (Learn more)