매핑 파라미터(Mapping parameters)
매핑 파라미터(Mapping parameters)
매핑 파라미터는 인덱스 필드의 동작을 구성하는 데 사용돼요. 이 페이지는 OpenSearch가 지원하는 모든 매핑 파라미터를 한눈에 보여 주는 목록 페이지예요. 각 파라미터의 사용 사례는 해당 파라미터의 개별 페이지를 참고하세요.
출처: 문서
본문
매핑 파라미터는 인덱스 필드의 동작을 구성하는 데 사용합니다. 파라미터별 사용 사례는 해당 매핑 파라미터의 개별 페이지를 참고하세요.
다음 표는 OpenSearch 매핑 파라미터를 나열합니다.
| 파라미터 | 설명 |
|---|---|
analyzer |
text 필드를 인덱싱하거나 검색할 때 텍스트 분석에 사용할 분석기를 지정하며, search_analyzer로 재정의하지 않는 한 인덱스 시점과 검색 시점 분석을 모두 처리합니다. |
boost |
필드의 점수 기여도에 승수를 적용해 검색 쿼리 중 관련성 점수를 높이거나 낮춥니다. |
coerce |
인덱싱 중 OpenSearch가 값을 정규화하고 변환해 필드의 데이터 타입과 일치시키려 할지 여부를 제어합니다(예: 문자열을 숫자로 변환하거나 부동 소수점을 정수로 잘라내기). |
copy_to |
여러 필드의 값을 그룹 필드로 복사해 원본 _source를 수정하지 않고 단일 필드로 쿼리할 수 있게 합니다. |
disable_objects |
점이 있는 필드 이름이 중첩 객체 구조로 확장되는지, 아니면 리터럴 평평한 필드 식별자로 취급되는지를 제어해 지표 및 분석 워크로드에서 결정적인 수집을 보장합니다. |
doc_values |
인덱스 생성 시 디스크 기반의 컬럼 지향 데이터 구조를 만들어 빠른 정렬, 집계, 스크립트에서의 필드 접근을 가능하게 할지 제어합니다. |
dynamic |
새로 감지된 필드를 매핑에 동적으로 추가할 수 있는지 지정합니다(옵션에는 true, false, strict, strict_allow_templates, false_allow_templates가 있습니다). |
eager_global_ordinals |
필드에 대한 전역 서수가 언제 구축되는지 제어하며, 지연 로딩은 쿼리 실행이 아니라 인덱스 리프레시 중에 계산해 집계 및 정렬 성능을 개선합니다. |
enabled |
OpenSearch가 필드 내용을 파싱하고 인덱싱할지 제어합니다. false로 설정하면 필드가 _source에 저장되지만 검색할 수 없습니다. |
fielddata |
text 필드의 분석된 토큰을 정렬, 집계, 스크립팅을 위해 메모리에 로드할 수 있게 합니다. 메모리 비용이 높아 기본적으로 비활성화되어 있습니다. |
fields |
대체 매핑(예: 다른 데이터 타입이나 분석기)을 가진 추가 하위 필드를 정의해 같은 필드를 여러 방식으로 인덱싱해 다양한 검색 및 집계 요구를 지원합니다. |
format |
date 필드가 인덱싱 중 받아들일 수 있는 내장 날짜 형식을 지정해 날짜 값의 올바른 파싱과 저장을 보장합니다. |
ignore_above |
인덱싱되는 문자열의 최대 문자 수를 제한합니다. 임계값을 초과하는 값은 인덱스 비대화를 방지하기 위해 저장되지만 인덱싱되지는 않습니다. |
ignore_malformed |
필드의 기대 형식과 일치하지 않는 값을 인덱싱 엔진이 무시하도록 지시해, 일부 필드에 파싱할 수 없는 데이터가 포함되어도 문서를 저장합니다. |
index |
필드가 역색인에 포함되는지 제어합니다. false로 설정하면 필드가 저장되지만(doc_values가 활성화되지 않는 한) 검색할 수 없습니다. |
index_options |
text 필드에 대해 역색인에 저장되는 세부 정보 수준을 제어합니다(옵션에는 docs, freqs, positions, offsets가 있습니다). 인덱스 크기와 스코어링, 구문 매칭, 하이라이팅 기능에 영향을 줍니다. |
index_phrases |
필드의 텍스트를 추가 처리해 구문 토큰(bigram)을 생성할지 결정해 인덱스 크기 증가를 대가로 구문 쿼리의 성능과 정확성을 개선합니다. |
index_prefixes |
text 필드의 용어 시작 세그먼트에 대한 추가 인덱스 항목을 생성해 자동 완성이나 검색-as-you-type 같은 접두어 쿼리의 성능을 크게 개선합니다. |
meta |
매핑 정의에 메타데이터를 첨부할 수 있게 하며, 인덱싱이나 검색 연산에는 영향을 주지 않고 정보 제공용 컨텍스트로 매핑과 함께 저장됩니다. |
normalizer |
keyword 필드에 대한 맞춤형 정규화 프로세스를 정의해 토큰 필터를 사용해 전체 필드 값을 단일 토큰으로 변환하면서 _source는 그대로 유지합니다. |
norms |
필드에 대해 정규화 요소를 계산하고 저장할지 제어해 관련성 스코어링을 조정합니다. 저장은 인덱스 크기와 메모리 소비를 증가시킵니다. |
null_value |
인덱싱 중 명시적 null 값을 사전 정의된 대체 값으로 바꿔, 문서 _source를 수정하지 않고 원래 null이던 필드에 대한 쿼리와 집계를 가능하게 합니다. |
position_increment_gap |
인덱싱 중 다중 값 필드의 토큰 사이 위치 거리를 정의해, 여러 값에 걸쳐 검색할 때 match_phrase와 span 쿼리의 동작에 영향을 줍니다(기본값은 100 위치). |
properties |
객체 또는 문서 루트 안의 필드 구조와 데이터 타입을 정의해 인덱싱, 저장, 검색 동작, 데이터 검증을 제어하는 모든 매핑 정의의 핵심이 됩니다. |
search_analyzer |
text 필드의 검색 시점에 사용할 분석기를 지정해, 인덱싱에 사용하는 분석기와 검색에 사용하는 분석기를 다르게 하여 용어 매칭을 더 잘 제어할 수 있게 합니다. |
similarity |
스코어링 알고리즘을 정의(옵션에는 BM25와 boolean이 있습니다)해 검색 중 text 필드의 관련성 점수가 계산되는 방식을 맞춤화합니다. |
store |
필드 값을 _source와 별도로 저장할지 결정하며, 검색 요청의 stored_fields 옵션을 사용해 직접 검색할 수 있게 합니다. |
term_vector |
맞춤형 스코어링과 하이라이팅 같은 고급 기능을 위해 인덱싱 중 text 필드의 용어 수준 정보(용어 빈도, 위치, 문자 오프셋)를 저장할지 제어합니다. |