mergeTreeTextIndex

mergeTreeTextIndex

MergeTree 테이블의 텍스트 인덱스 사전(dictionary)을 나타내는 테이블 함수예요. 토큰과 그 포스팅 리스트 메타데이터를 반환하며, 내부 구조를 들여다보는(introspection) 용도로 사용해요.

출처: 문서

본문

MergeTree 테이블의 텍스트 인덱스 사전을 나타내요.

토큰과 그 포스팅 리스트 메타데이터를 반환해요.

내부 구조를 들여다보는 데 사용할 수 있어요.

문법 (Syntax)

mergeTreeTextIndex(database, table, index_name)

인자 (Arguments)

인자 설명
database 텍스트 인덱스를 읽을 데이터베이스 이름이에요.
table 텍스트 인덱스를 읽을 테이블 이름이에요.
index_name 읽을 텍스트 인덱스예요.

반환값 (Returned value)

토큰과 그 포스팅 리스트 메타데이터를 가진 테이블 객체예요.

사용 예시 (Usage Example)

쿼리:

CREATE TABLE tab
(
 id UInt64,
 s String,
 INDEX idx_s (s) TYPE text(tokenizer = splitByNonAlpha)
)
ENGINE = MergeTree
ORDER BY id;

INSERT INTO tab SELECT number, concatWithSeparator(' ', 'apple', 'banana') FROM numbers(500);
INSERT INTO tab SELECT 500 + number, concatWithSeparator(' ', 'cherry', 'date') FROM numbers(500);

SELECT * FROM mergeTreeTextIndex(currentDatabase(), tab, idx_s);

응답:

 ┌─part_name─┬─token──┬─dictionary_compression─┬─cardinality─┬─num_posting_blocks─┬─has_embedded_postings─┬─has_raw_postings─┬─has_compressed_postings─┐
1. │ all_1_1_0 │ apple │ front_coded │ 500 │ 1 │ 0 │ 0 │ 0 │
2. │ all_1_1_0 │ banana │ front_coded │ 500 │ 1 │ 0 │ 0 │ 0 │
3. │ all_2_2_0 │ cherry │ front_coded │ 500 │ 1 │ 0 │ 0 │ 0 │
4. │ all_2_2_0 │ date │ front_coded │ 500 │ 1 │ 0 │ 0 │ 0 │
 └───────────┴────────┴────────────────────────┴─────────────┴────────────────────┴───────────────────────┴──────────────────┴─────────────────────────┘

더 알아보기 (Learn more)