Token count 필드 타입
Token count 필드 타입
token_count 필드 타입은 문자열 안의 분석된 토큰 수를 저장해요.
출처: 문서
본문
예시
token count 필드가 있는 매핑을 만들어 볼게요.
PUT testindex
{
"mappings": {
"properties": {
"sentence": {
"type": "text",
"fields": {
"num_words": {
"type": "token_count",
"analyzer": "english"
}
}
}
}
}
}
text 필드가 있는 문서 세 개를 색인해요.
PUT testindex/_doc/1
{ "sentence": "To be, or not to be: that is the question." }
PUT testindex/_doc/2
{ "sentence": "All the world's a stage, and all the men and women are merely players." }
PUT testindex/_doc/3
{ "sentence": "Now is the winter of our discontent." }
10단어 미만인 문장을 검색해요.
GET testindex/_search
{
"query": {
"range": {
"sentence.num_words": {
"lt": 10
}
}
}
}
응답에는 매칭된 문장 하나가 포함돼요.
{
"took" : 8,
"timed_out" : false,
"_shards" : {
"total" : 1,
"successful" : 1,
"skipped" : 0,
"failed" : 0
},
"hits" : {
"total" : {
"value" : 1,
"relation" : "eq"
},
"max_score" : 1.0,
"hits" : [
{
"_index" : "testindex",
"_type" : "_doc",
"_id" : "3",
"_score" : 1.0,
"_source" : {
"sentence" : "Now is the winter of our discontent."
}
}
]
}
}
파라미터 (Parameters)
token count 필드 타입이 받는 파라미터는 다음 표와 같아요. analyzer 파라미터는 필수이며, 다른 모든 파라미터는 선택 사항이에요.
| 파라미터 | 설명 |
|---|---|
analyzer |
이 필드에 사용될 analyzer예요. 최적의 성능을 위해 token filter가 없는 analyzer를 지정하세요. 필수예요. 동적으로 업데이트 가능해요. |
boost |
관련성 점수에 대한 이 필드의 가중치를 지정하는 부동소수점 값이에요. 1.0보다 큰 값은 필드의 관련성을 높이고, 0.0과 1.0 사이의 값은 관련성을 낮춰요. 기본값은 1.0이에요. 동적으로 업데이트 가능해요. |
doc_values |
집계, 정렬, 스크립팅에 사용할 수 있도록 필드를 디스크에 저장할지 여부를 지정하는 불리언 값이에요. 기본값은 false예요. |
enable_position_increments |
위치 증가분(position increments)을 셀지 여부를 지정하는 불리언 값이에요. 불용어 제거를 피하려면 이 필드를 false로 설정해요. 기본값은 true예요. |
index |
필드를 검색 가능하게 할지 여부를 지정하는 불리언 값이에요. 기본값은 true예요. |
null_value |
null 대신 사용할 값이에요. 필드와 같은 타입이어야 해요. 이 파라미터를 지정하지 않으면 값이 null일 때 필드가 없는 것으로 처리돼요. 기본값은 null이에요. |
store |
필드 값을 저장하고 _source 필드와 별도로 검색할 수 있게 할지 여부를 지정하는 불리언 값이에요. 기본값은 false예요. |