SplitRecord

SplitRecord

레코드 지향 데이터 형식의 입력 FlowFile을 여러 개의 더 작은 FlowFile로 나누는 프로세서예요. 분할당 레코드 수를 지정해 사용할 수 있어요.

출처: Snowflake 문서

본문

번들 (Bundle)

org.apache.nifi | nifi-standard-nar

설명 (Description)

레코드 지향 데이터 형식의 입력 FlowFile을 여러 개의 더 작은 FlowFile로 나눕니다.

태그 (Tags)

avro, csv, freeform, generic, json, log, logs, schema, split, text

입력 요구사항 (Input Requirement)

REQUIRED

민감 동적 속성 지원 (Supports Sensitive Dynamic Properties)

false

속성 (Properties)

속성 (Property) 설명 (Description)
Record Reader 들어오는 데이터를 읽는 데 사용할 Controller Service를 지정합니다.
Record Writer 레코드를 쓰는 데 사용할 Controller Service를 지정합니다.
Records Per Split 각 'split' 또는 'segment' FlowFile에 몇 개의 레코드를 써야 하는지 지정합니다.

관계 (Relationships)

이름 (Name) 설명 (Description)
failure FlowFile을 구성된 입력 형식에서 구성된 출력 형식으로 변환할 수 없으면, 변경되지 않은 FlowFile이 이 관계로 라우팅됩니다.
original 입력 FlowFile을 성공적으로 분할하면 원본 FlowFile이 이 관계로 보내집니다.
splits 원본 FlowFile의 개별 '세그먼트'가 이 관계로 라우팅됩니다.

쓰는 속성 (Writes attributes)

이름 (Name) 설명 (Description)
mime.type Record Writer가 지정한 MIME Type으로, 'splits' Relationship으로 라우팅된 FlowFiles의 mime.type 속성을 설정합니다.
record.count FlowFile의 레코드 수입니다. 'splits' Relationship으로 라우팅된 FlowFiles에 추가됩니다.
fragment.identifier 같은 부모 FlowFile에서 만들어진 모든 분할 FlowFile은 이 속성에 대해 같은 무작위 생성 UUID를 갖습니다.
fragment.index 단일 부모 FlowFile에서 생성된 분할 FlowFile의 순서를 나타내는 일련 번호입니다.
fragment.count 부모 FlowFile에서 생성된 분할 FlowFile의 수입니다.
segment.original.filename 부모 FlowFile의 파일 이름입니다.

더 알아보기 (Learn more)