mergeTreeTextIndex
mergeTreeTextIndex
MergeTree 테이블의 텍스트 인덱스 사전(dictionary)을 나타내는 테이블 함수예요. 토큰과 그 포스팅 리스트 메타데이터를 반환하며, 내부 구조를 들여다보는(introspection) 용도로 사용해요.
출처: 문서
본문
MergeTree 테이블의 텍스트 인덱스 사전을 나타내요.
토큰과 그 포스팅 리스트 메타데이터를 반환해요.
내부 구조를 들여다보는 데 사용할 수 있어요.
문법 (Syntax)
mergeTreeTextIndex(database, table, index_name)
인자 (Arguments)
| 인자 | 설명 |
|---|---|
database |
텍스트 인덱스를 읽을 데이터베이스 이름이에요. |
table |
텍스트 인덱스를 읽을 테이블 이름이에요. |
index_name |
읽을 텍스트 인덱스예요. |
반환값 (Returned value)
토큰과 그 포스팅 리스트 메타데이터를 가진 테이블 객체예요.
사용 예시 (Usage Example)
쿼리:
CREATE TABLE tab
(
id UInt64,
s String,
INDEX idx_s (s) TYPE text(tokenizer = splitByNonAlpha)
)
ENGINE = MergeTree
ORDER BY id;
INSERT INTO tab SELECT number, concatWithSeparator(' ', 'apple', 'banana') FROM numbers(500);
INSERT INTO tab SELECT 500 + number, concatWithSeparator(' ', 'cherry', 'date') FROM numbers(500);
SELECT * FROM mergeTreeTextIndex(currentDatabase(), tab, idx_s);
응답:
┌─part_name─┬─token──┬─dictionary_compression─┬─cardinality─┬─num_posting_blocks─┬─has_embedded_postings─┬─has_raw_postings─┬─has_compressed_postings─┐
1. │ all_1_1_0 │ apple │ front_coded │ 500 │ 1 │ 0 │ 0 │ 0 │
2. │ all_1_1_0 │ banana │ front_coded │ 500 │ 1 │ 0 │ 0 │ 0 │
3. │ all_2_2_0 │ cherry │ front_coded │ 500 │ 1 │ 0 │ 0 │ 0 │
4. │ all_2_2_0 │ date │ front_coded │ 500 │ 1 │ 0 │ 0 │ 0 │
└───────────┴────────┴────────────────────────┴─────────────┴────────────────────┴───────────────────────┴──────────────────┴─────────────────────────┘