모든 프로세서
모든 프로세서 (알파벳순)
이 문서는 Snowflake Openflow 프로세서 전체를 알파벳순으로 정리한 목록이에요. 각 프로세서의 이름과 요약을 제공합니다.
목록에는 다음이 포함됩니다:
- 각 프로세서의 이름
- 각 프로세서의 요약
출처: Snowflake 문서
본문
기능 — 일반 공급 (Generally Available)
Openflow Snowflake 배포는 AWS, Azure, GCP 상용(Commercial) 리전의 모든 계정에서 사용할 수 있어요. Openflow BYOC 배포는 AWS 상용 리전의 모든 계정에서 사용할 수 있습니다.
A
| 프로세서 | 설명 |
|---|---|
AbortQueryJob |
Bulk API 2를 사용해 Salesforce에서 Query Job을 중단합니다. |
AttributesToCSV |
입력 FlowFile 속성의 CSV 표현을 생성합니다. |
AttributesToJSON |
입력 FlowFile 속성의 JSON 표현을 생성합니다. |
C
| 프로세서 | 설명 |
|---|---|
CalculateRecordStats |
레코드 집합의 레코드 수를 세고, 사용자 정의 속성으로 정의된 범주별 요소 수를 선택적으로 셉니다. |
CaptureChangeMySQL |
MySQL 데이터베이스에서 CDC 이벤트를 읽습니다. |
CaptureChangePostgreSQL |
PostgreSQL 데이터베이스에서 CDC 이벤트를 읽습니다. |
CaptureChangeSqlServer |
SQL Server 데이터베이스에서 CDC 이벤트를 읽습니다. |
CaptureGoogleDriveChanges |
공유 Google Drive의 변경 사항을 캡처하고 발생하는 각 변경에 대해 FlowFile을 내보냅니다. |
CaptureMicrosoft365GroupsChanges |
Microsoft365 그룹 변경 사항을 캡처하고 발생하는 각 변경에 대해 FlowFile을 내보냅니다. |
CaptureSharepointChanges |
Sharepoint Document Library의 변경 사항을 캡처하고 발생하는 각 변경에 대해 FlowFile을 내보냅니다. |
CheckMetaAdsReportReadiness |
Meta Ads 보고서가 다운로드 준비가 되었는지 확인하는 프로세서입니다. |
ChunkRecordText |
구분자와 최대 문자 길이로 재귀적으로 분할하는 옵션으로 텍스트를 청크합니다. |
ChunkText |
구분자와 최대 문자 길이로 재귀적으로 분할하는 옵션으로 텍스트를 청크합니다. |
CompressContent |
사용자 지정 압축 알고리즘으로 FlowFile 콘텐츠를 압축하거나 해제하고 mime.type 속성을 업데이트합니다. |
ConnectWebSocket |
원격 WebSocket 서버와 상호 작용하는 WebSocket 클라이언트 엔드포인트 역할을 합니다. |
ConsumeAMQP |
AMQP 0-9-1 브로커에서 AMQP 메시지를 소비합니다. |
ConsumeAzureEventHub |
일관된 이벤트 처리를 보장하는 체크포인팅으로 Microsoft Azure Event Hubs에서 메시지를 수신합니다. |
ConsumeBoxEnterpriseEvents |
Box admin_logs_streaming Stream 유형에서 Enterprise Events를 소비합니다. |
ConsumeBoxEvents |
Box의 모든 이벤트를 소비합니다. |
ConsumeElasticsearch |
Range 쿼리로 필드에 대해 페이징된 쿼리를 반복 실행해 Elasticsearch 인덱스/쿼리에서 새 문서를 소비하는 프로세서입니다. |
ConsumeGCPubSub |
구성된 Google Cloud PubSub 구독에서 메시지를 소비합니다. |
ConsumeIMAP |
IMAP 프로토콜을 사용해 이메일 서버에서 메시지를 소비합니다. |
ConsumeJMS |
BytesMessage, TextMessage, ObjectMessage, MapMessage 또는 StreamMessage 유형의 JMS 메시지를 소비해 콘텐츠를 FlowFile로 변환하고 'success' 관계로 전환합니다. |
ConsumeKafka |
Apache Kafka Consumer API에서 메시지를 소비합니다. |
ConsumeKinesisStream |
지정된 AWS Kinesis 스트림에서 데이터를 읽고, 처리된 각 Record(원시)에 대해 FlowFile을 출력하거나 Record Reader와 Record Writer가 구성되면 처리된 레코드 배치에 대해 FlowFile을 출력합니다. |
ConsumeMQTT |
토픽을 구독하고 MQTT 브로커에서 메시지를 수신합니다. |
ConsumePOP3 |
POP3 프로토콜을 사용해 이메일 서버에서 메시지를 소비합니다. |
ConsumeSlack |
하나 이상의 구성된 Slack 채널에서 메시지를 조회합니다. |
ConsumeSlackConversation |
앱에서 사용할 수 있는 Slack 대화에서 메시지를 조회합니다. |
ConsumeSlackHistory |
앱에서 사용할 수 있는 모든 Slack 채널의 과거 메시지를 가져옵니다. |
ConsumeSnowflakeStream |
Snowflake 스트림에서 데이터를 가져와 FlowFile에 기록합니다. |
ConsumeTwitter |
Twitter의 스트리밍 API v2에서 트윗을 스트리밍합니다. |
ControlRate |
데이터가 후속 프로세서로 전송되는 속도를 제어합니다. |
ConvertCharacterSet |
FlowFile의 콘텐츠를 한 문자 집합에서 다른 문자 집합으로 변환합니다. |
ConvertRecord |
구성된 Record Reader와 Record Writer 컨트롤러 서비스를 사용해 레코드를 한 데이터 형식에서 다른 형식으로 변환합니다. |
ConvertToJournalSchema |
들어오는 데이터베이스 스키마를 Snowflake CDC Journal 테이블에 적합한 스키마로 변환합니다. |
CopyAzureBlobStorage_v12 |
Azure Blob Storage에서 blob을 한 계정/컨테이너에서 다른 곳으로 복사합니다. |
CopyS3Object |
AWS S3에서 파일을 한 버킷/키에서 다른 곳으로 복사합니다. |
CountText |
들어오는 텍스트의 다양한 지표를 셉니다. |
CreateAmazonAdsReport |
Amazon Ads 커넥터의 보고서 구성을 만드는 프로세서입니다. |
CreateAzureOpenAiEmbeddings |
Azure OpenAI를 사용해 텍스트에 대한 임베딩을 만듭니다. |
CreateBoxFileMetadataInstance |
FlowFile 콘텐츠의 값과 함께 지정된 템플릿을 사용해 Box 파일의 메타데이터 인스턴스를 생성합니다. |
CreateBoxMetadataTemplate |
FlowFile 콘텐츠의 필드 사양을 사용해 Box 메타데이터 템플릿을 생성합니다. |
CreateCohereEmbeddings |
Cohere를 사용해 텍스트에 대한 임베딩을 만듭니다. |
CreateMetaAdsReport |
Meta Ads 커넥터의 보고서 구성을 만드는 프로세서입니다. |
CreateOpenAiEmbeddings |
OpenAI를 사용해 텍스트에 대한 임베딩을 만듭니다. |
CreateSnowflakeEmbeddings |
Snowflake Cortex Large Language Model 함수를 사용해 벡터 임베딩을 만듭니다. |
CreateVertexAIEmbeddings |
VertexAI를 사용해 텍스트에 대한 임베딩을 만듭니다. |
CryptographicHashContent |
주어진 알고리즘을 사용해 FlowFile 콘텐츠의 암호화 해시 값을 계산하고 출력 속성에 기록합니다. |
D
| 프로세서 | 설명 |
|---|---|
DebugFlow |
DebugFlow 프로세서는 타이머 또는 cron 기반 스케줄링을 사용하는 경우 FlowFile 수신 또는 FlowFile 없는 타이머 이벤트에 응답하여 다양한 응답을 명시적으로 트리거함으로써 FlowFile 프레임워크 테스트 및 디버깅을 돕습니다. |
DecryptContentAge |
age-encryption을 사용해 콘텐츠를 복호화합니다. |
DecryptContentPGP |
OpenPGP 메시지의 콘텐츠를 복호화합니다. |
DeduplicateRecord |
이 프로세서는 레코드 집합 내에서 개별 레코드를 중복 제거합니다. |
DeleteAzureBlobStorage_v12 |
Azure Blob Storage에서 지정된 blob을 삭제합니다. |
DeleteAzureDataLakeStorage |
Azure Data Lake Storage에서 제공된 파일을 삭제합니다. |
DeleteBoxFileMetadataInstance |
지정된 템플릿 키를 사용해 Box 파일의 메타데이터 인스턴스를 삭제합니다. |
DeleteByQueryElasticsearch |
쿼리를 사용해 Elasticsearch 인덱스에서 삭제합니다. |
DeleteDBFSResource |
DBFS 파일과 디렉터리를 삭제합니다. |
DeleteDynamoDB |
해시 및 범위 키를 기반으로 DynamoDB에서 문서를 삭제합니다. |
DeleteFile |
파일 시스템에서 파일을 삭제합니다. |
DeleteGCSObject |
Google Cloud 버킷에서 객체를 삭제합니다. |
DeleteGridFS |
파일 이름 또는 쿼리를 사용해 GridFS에서 파일을 삭제합니다. |
DeleteMilvus |
컬렉션에서 ID로 Milvus 데이터베이스의 벡터를 삭제합니다. |
DeleteMongo |
MongoDB 컬렉션에 대해 삭제 쿼리를 실행합니다. |
DeletePinecone |
Pinecone 인덱스에서 벡터를 삭제합니다. |
DeleteQueryJob |
Bulk API 2를 사용해 Salesforce에서 Query Job을 삭제합니다. |
DeleteS3Object |
Amazon S3 버킷에서 파일을 삭제합니다. |
DeleteSFTP |
SFTP 서버에 있는 파일을 삭제합니다. |
DeleteSQS |
Amazon Simple Queuing Service 큐에서 메시지를 삭제합니다. |
DeleteUnityCatalogResource |
Unity Catalog 파일 또는 디렉터리를 삭제합니다. |
DescribeDataShare |
Salesforce Data Cloud에서 지정된 데이터 공유 메타데이터를 설명합니다. |
DescribeSFDCObject |
Salesforce에서 지정된 객체 메타데이터를 설명합니다. |
DetectDuplicate |
각 들어오는 FlowFile에 대해 FlowFile 속성에서 계산된 값을 캐시하고 캐시된 값이 이미 보였는지 여부를 판단합니다. |
DistributeLoad |
Distribution Strategy에 따라 FlowFile을 다운스트림 프로세서에 분배합니다. |
DuplicateFlowFile |
부하 테스트를 위해 설계되었으며, 들어오는 각 FlowFile의 구성된 수만큼 복사본을 생성합니다. |
E
| 프로세서 | 설명 |
|---|---|
EncodeContent |
Base64, Base32 또는 hex 인코딩 체계를 사용해 FlowFile 콘텐츠를 인코딩하거나 디코딩합니다. |
EncryptContentAge |
age-encryption을 사용해 콘텐츠를 암호화합니다. |
EncryptContentPGP |
OpenPGP를 사용해 콘텐츠를 암호화합니다. |
EnforceOrder |
단일 노드 내에서 동일한 데이터 그룹에 속하는 FlowFile의 예상 순서를 강제합니다. |
EnrichAttributes |
구성된 Lookup Service를 사용해 값을 조회하고 결과를 FlowFile에 하나 이상의 속성으로 추가합니다. |
EnrichCdcStream |
CaptureChangePostgreSQL 등에서 오는 들어오는 FlowFile을 강화합니다. |
EvaluateJsonPath |
FlowFile의 콘텐츠에 대해 하나 이상의 JsonPath 표현식을 평가합니다. |
EvaluateRagAnswerCorrectness |
F1 점수, 코사인 유사도, 답변 정확도 같은 지표를 계산하여 Retrieval-Augmented Generation(RAG) 맥락에서 생성된 답변의 정확성을 평가합니다. |
EvaluateRagFaithfulness |
LLM으로 응답을 분석하여 Retrieval-Augmented Generation(RAG) 시스템에서 생성된 답변의 충실성을 평가합니다. |
EvaluateRagRetrieval |
LLM을 판정자로 사용해 RAG 시스템의 검색 지표(Precision@N, Recall@N, FScore@N, MAP@N, MRR)를 계산합니다. |
EvaluateXPath |
FlowFile의 콘텐츠에 대해 하나 이상의 XPath를 평가합니다. |
EvaluateXQuery |
FlowFile의 콘텐츠에 대해 하나 이상의 XQuery를 평가합니다. |
ExecuteGroovyScript |
실험적(Experimental) 확장 Groovy 스크립트 프로세서입니다. |
ExecuteProcess |
사용자가 지정한 운영 체제 명령을 실행하고 해당 명령의 출력을 FlowFile에 기록합니다. |
ExecuteScript |
실험적 - Flow file과 프로세스 세션을 고려해 스크립트를 실행합니다. |
ExecuteSQL |
제공된 SQL select 쿼리를 실행합니다. |
ExecuteSQLRecord |
제공된 SQL select 쿼리를 실행합니다. |
ExecuteSQLStatement |
데이터베이스에 대해 SQL DDL 또는 DML 문을 실행합니다. |
ExecuteStreamCommand |
ExecuteStreamCommand 프로세서는 외부 명령과 스크립트를 NiFi 데이터 흐름에 통합하는 유연한 방법을 제공합니다. |
ExtractAvroMetadata |
Avro 데이터 파일의 헤더에서 메타데이터를 추출합니다. |
ExtractEmailAttachments |
mime 형식의 이메일 파일에서 첨부 파일을 추출하여 개별 FlowFile로 분할합니다. |
ExtractEmailHeaders |
FlowFile 콘텐츠를 데이터 소스로 사용해 RFC 호환 이메일 파일에서 헤더를 추출하고 관련 속성을 FlowFile에 추가합니다. |
ExtractGrok |
FlowFile의 콘텐츠에 대해 하나 이상의 Grok 표현식을 평가해 결과를 속성으로 추가하거나 일치된 콘텐츠의 JSON 표기로 FlowFile 콘텐츠를 대체합니다. |
ExtractRecordSchema |
제공된 Record Reader를 사용해 FlowFile에서 레코드 스키마를 추출하고 'avro.schema' 속성에 기록합니다. |
ExtractSchemaColumns |
제공된 Record Reader를 사용해 FlowFile에서 레코드 스키마 열을 추출하고 'schema.columns' 속성에 기록합니다. |
ExtractStructuredBoxFileMetadata |
Box AI를 사용해 Box 파일에서 메타데이터를 추출합니다. |
ExtractText |
FlowFile의 콘텐츠에 대해 하나 이상의 정규식(Regular Expression)을 평가합니다. |
F
| 프로세서 | 설명 |
|---|---|
FetchAzureBlobStorage_v12 |
Azure Blob Storage에서 지정된 blob을 가져와 그 콘텐츠를 FlowFile 콘텐츠에 기록합니다. |
FetchAzureDataLakeStorage |
Azure Data Lake Storage에서 지정된 파일을 가져옵니다. |
FetchBoxFile |
Box 폴더에서 파일을 가져옵니다. |
FetchBoxFileInfo |
Box에서 파일의 메타데이터를 가져와 FlowFile의 속성에 추가합니다. |
FetchBoxFileMetadataInstance |
템플릿 키와 범위를 사용해 Box 파일과 연결된 특정 메타데이터 인스턴스를 조회합니다. |
FetchBoxFileRepresentation |
표현 힌트(representation hint)를 사용해 Box 파일 표현을 가져와 FlowFile 콘텐츠에 기록합니다. |
FetchDistributedMapCache |
각 들어오는 FlowFile에 대해 FlowFile 속성에서 캐시 키를 계산하고 각 키와 연결된 Distributed Map Cache에서 값을 가져옵니다. |
FetchDropbox |
Dropbox에서 파일을 가져옵니다. |
FetchFile |
디스크에서 파일 콘텐츠를 읽어 들어오는 FlowFile의 콘텐츠로 스트리밍합니다. |
FetchFTP |
원격 FTP 서버에서 파일 콘텐츠를 가져와 들어오는 FlowFile의 콘텐츠를 원격 파일 콘텐츠로 덮어씁니다. |
FetchGCSObject |
Google Cloud 버킷에서 파일을 가져옵니다. |
FetchGoogleDrive |
Google Drive 폴더에서 파일을 가져옵니다. |
FetchGoogleDriveFileComments |
Google Drive 파일의 댓글과 답글을 가져옵니다. |
FetchGoogleDriveMetadata |
Google Drive 파일 메타데이터를 가져옵니다. |
FetchGridFS |
파일 이름 또는 사용자 정의 쿼리로 GridFS 버킷에서 하나 이상의 파일을 가져옵니다. |
FetchJiraFields |
REST API v3 /field 엔드포인트를 사용해 Jira Cloud 인스턴스에서 사용 가능한 모든 필드의 포괄적인 메타데이터를 가져옵니다. |
FetchJiraIssues |
구성 가능한 검색 옵션으로 REST API v3를 사용해 Jira Cloud에서 이슈를 가져옵니다. |
FetchMicrosoftDataverseTable |
Microsoft Dataverse 테이블에서 레코드를 가져옵니다. |
FetchS3Object |
S3 객체의 콘텐츠를 조회해 FlowFile 콘텐츠에 기록합니다. |
FetchSFTP |
원격 SFTP 서버에서 파일 콘텐츠를 가져와 들어오는 FlowFile의 콘텐츠를 원격 파일 콘텐츠로 덮어씁니다. |
FetchSharepointFile |
Sharepoint Drive에서 파일 콘텐츠를 가져오며, 해당하는 경우 파일의 PDF 또는 HTML 버전을 선택적으로 다운로드합니다. |
FetchSharepointMetadata |
각 드라이브 항목에 대해 메타데이터와 권한을 가져와 FlowFile 속성으로 기록합니다. |
FetchSlackConversationInfo |
Slack 대화 정보와 구성원 이메일을 가져옵니다. |
FetchSlackFile |
Slack에서 공유된 파일을 다운로드합니다. |
FetchSlackMessage |
단일 Slack 메시지에 대한 데이터를 가져옵니다. |
FetchSmb |
SMB 공유에서 파일을 가져옵니다. |
FetchSnowflakeTableProperties |
테이블의 속성을 읽어 Flow file 속성으로 저장합니다. |
FetchSourceTableSchema |
테이블 스키마를 가져옵니다. |
FetchTableSnapshot |
데이터베이스에서 테이블의 스냅샷을 가져옵니다. |
FilterAttribute |
지정된 속성을 유지하고 나머지를 제거하거나, 지정된 속성을 제거하고 나머지를 유지하여 FlowFile의 속성을 필터링합니다. |
FindConfluencePages |
space 이름과 페이지 이름을 사용해 Confluence 페이지를 찾는 프로세서입니다. |
FindSharepointDriveItem |
Drive ID와 항목 경로로 Sharepoint Drive Item을 찾습니다. |
FlattenJson |
중첩된 JSON 문서를 가져와 단순한 키/값 쌍 문서로 평탄화(flatten)할 수 있게 해줍니다. |
ForkEnrichment |
JoinEnrichment 프로세서와 함께 사용되며, JoinEnrichment 프로세서가 기능을 수행하는 데 필요한 속성을 추가하는 역할을 합니다. |
ForkRecord |
이 프로세서는 레코드를 여러 레코드로 포크(fork)할 수 있게 해줍니다. |
G
| 프로세서 | 설명 |
|---|---|
GenerateAnswersFromContext |
대규모 언어 모델(LLM)을 사용해 들어오는 레코드에 있는 각 질문에 대한 합성 답변을 생성합니다. |
GenerateAnswersFromGroundTruth |
LLM을 사용해 들어오는 레코드의 각 질문에 대한 합성 답변을 생성합니다. |
GenerateFlowFile |
이 프로세서는 임의의 데이터 또는 사용자 지정 콘텐츠로 FlowFile을 생성합니다. |
GenerateJSON |
구성 가능한 JSON Schema를 기반으로 임의의 필드 값을 가진 JSON 객체 배치를 생성합니다. |
GenerateRecord |
이 프로세서는 지정된 필드에 대해 임의의 값을 가진 레코드로 FlowFile을 생성합니다. |
GenerateTableFetch |
테이블에서 "페이지"의 행을 가져오는 SQL select 쿼리를 생성합니다. |
GeoEnrichIP |
IP 주소에 대한 지리적 위치 정보를 조회해 지리 정보를 FlowFile 속성에 추가합니다. |
GeoEnrichIPRecord |
IP 주소에 대한 지리적 위치 정보를 조회해 지리 정보를 FlowFile 속성에 추가합니다. |
GetAmazonAdsReport |
준비되면 Amazon Ads에서 보고서를 다운로드하는 프로세서입니다. |
GetAwsPollyJobStatus |
AWS Polly 작업의 현재 상태를 조회합니다. |
GetAwsTextractJobStatus |
AWS Textract 작업의 현재 상태를 조회합니다. |
GetAwsTranscribeJobStatus |
AWS Transcribe 작업의 현재 상태를 조회합니다. |
GetAwsTranslateJobStatus |
AWS Translate 작업의 현재 상태를 조회합니다. |
GetAzureEventHub |
안정적인 체크포인트 추적 없이 Microsoft Azure Event Hubs에서 메시지를 수신합니다. |
GetAzureQueueStorage_v12 |
Azure Queue Storage에서 메시지를 조회합니다. |
GetBoxFileCollaborators |
Box 파일의 모든 협업자(collaborator)를 조회하고 협업 정보를 FlowFile 속성에 추가합니다. |
GetBoxGroupMembers |
Box 그룹의 구성원을 조회하고 그 세부 정보를 FlowFile 속성에 기록합니다. |
GetConfluenceAuditRecords |
Confluence 감사 레코드를 나열하는 프로세서입니다. |
GetConfluenceGroupUsers |
주어진 Confluence 그룹에 속한 사용자에 대한 정보를 다운로드하는 프로세서입니다. |
GetConfluencePageContent |
Confluence 페이지를 다운로드하는 프로세서입니다. |
GetConfluencePageIds |
마지막 동기화 이후 변경된 Confluence 페이지를 다운로드하고 각 페이지를 메타데이터와 함께 FlowFile로 내보냅니다. |
GetConfluencePagePermissions |
Confluence 페이지 권한을 다운로드하는 프로세서입니다. |
GetConfluenceSpaceIds |
Confluence space id를 조회하는 프로세서입니다. |
GetConfluenceSpacePermissions |
Confluence space 권한을 다운로드하는 프로세서입니다. |
GetDataShareCredentials |
Salesforce Data Cloud에서 지정된 데이터 공유 메타데이터를 설명합니다. |
GetDataShareTables |
Salesforce Data Cloud에서 지정된 데이터 공유 메타데이터를 설명합니다. |
GetDBFSFile |
DBFS 파일을 읽습니다. |
GetDynamoDB |
해시 및 범위 키를 기반으로 DynamoDB에서 문서를 조회합니다. |
GetElasticsearch |
공식 Elastic REST 클라이언트 라이브러리를 사용해 _id로 Elasticsearch에서 단일 문서를 가져오는 Elasticsearch get 프로세서입니다. |
GetFile |
디렉터리의 파일에서 FlowFile을 생성합니다. |
GetFileResource |
이 프로세서는 구성된 File Resource의 콘텐츠로 FlowFile을 생성합니다. |
GetFTP |
FTP 서버에서 파일을 가져와 FlowFile을 생성합니다. |
GetGcpVisionAnnotateFilesOperationStatus |
Google Vision 작업의 현재 상태를 조회합니다. |
GetGcpVisionAnnotateImagesOperationStatus |
Google Vision 작업의 현재 상태를 조회합니다. |
GetGoogleAdsReport |
Google Ads Reporting API와 상호 작용할 수 있는 프로세서입니다. |
GetGoogleGroupMembers |
FlowFile 속성으로 주어진, 쉼표로 구분된 그룹 ID 목록으로 지정된 하나 이상의 Google 그룹 구성원을 조회합니다. |
GetGoogleSheets |
Google Sheets에서 데이터를 가져오는 역할을 하는 프로세서입니다. |
GetHubSpot |
비공개 HubSpot 애플리케이션에서 JSON 데이터를 조회합니다. |
GetHubSpotObject |
ID 또는 고유 값으로 HubSpot 객체와 그 연관(association) 정보를 가져옵니다. |
GetHubSpotSchema |
필드 이름, 타입, 라벨을 포함해 HubSpot 객체 유형의 스키마 정보를 조회합니다. |
GetLinkedInAdsReport |
LinkedIn Reporting API에서 지표를 다운로드하는 프로세서입니다. |
GetMicrosoft365GroupMembers |
Microsoft365 그룹 구성원을 조회하고 발생하는 각 변경에 대해 FlowFile을 내보냅니다. |
GetMongo |
사용자 지정 쿼리로 MongoDB에서 로드된 문서에서 FlowFile을 생성합니다. |
GetMongoRecord |
MongoDB 결과 집합을 기록하는 데 Record Writer를 사용하는 GetMongo의 레코드 기반 버전입니다. |
GetQueryJobResult |
Bulk API 2를 사용해 Salesforce에서 Query Job의 결과를 가져옵니다. |
GetQueryJobStatus |
Bulk API 2를 사용해 Salesforce에서 Query Job의 상태를 가져옵니다. |
GetS3ObjectMetadata |
다운로드를 시도하지 않고 S3 객체의 존재 여부를 확인하고 메타데이터를 가져옵니다. |
GetS3ObjectTags |
다운로드를 시도하지 않고 S3 객체의 존재 여부를 확인하고 태그를 가져옵니다. |
GetSFTP |
SFTP 서버에서 파일을 가져와 FlowFile을 생성합니다. |
GetSharepointSiteGroupMembers |
SharePoint 사이트 그룹의 모든 구성원을 조회합니다. |
GetShopify |
사용자 지정 Shopify 스토어에서 객체를 조회합니다. |
GetSmbFile |
Samba 네트워크 위치에서 파일을 읽어 FlowFile로 만듭니다. |
GetSplunk |
Splunk Enterprise에서 데이터를 조회합니다. |
GetSQS |
Amazon Simple Queuing Service 큐에서 메시지를 가져옵니다. |
GetUnityCatalogFile |
최대 5 GiB 크기의 Unity Catalog 파일을 읽습니다. |
GetUnityCatalogFileMetadata |
Unity Catalog 파일 메타데이터를 확인합니다. |
GetWorkdayReport |
구성 가능한 Workday Report와 상호 작용할 수 있는 프로세서입니다. |
GetZendesk |
Zendesk API에서 데이터를 증분 방식으로 가져옵니다. |
H
| 프로세서 | 설명 |
|---|---|
HandleHttpRequest |
HTTP 서버를 시작하고 HTTP 요청을 수신합니다. |
HandleHttpResponse |
FlowFile을 생성한 요청자에게 HTTP 응답을 보냅니다. |
I
| 프로세서 | 설명 |
|---|---|
IdentifyMimeType |
FlowFile에 사용된 MIME 타입을 식별하려 시도합니다. |
InvokeHTTP |
구성 가능한 HTTP 엔드포인트와 상호 작용할 수 있는 HTTP 클라이언트 프로세서입니다. |
InvokeScriptedProcessor |
실험적(Experimental) - 주어진 스크립트에 정의된 프로세서를 위해 스크립트 엔진을 호출합니다. |
ISPEnrichIP |
IP 주소에 대한 ISP 정보를 조회해 FlowFile 속성에 추가합니다. |
J
| 프로세서 | 설명 |
|---|---|
JoinEnrichment |
두 개의 서로 다른 FlowFile의 레코드를 결합합니다. 하나의 FlowFile('original')은 임의의 레코드를 포함하고, 두 번째 FlowFile('enrichment')은 첫 번째를 강화하는 데 사용할 추가 데이터를 포함합니다. |
JoltTransformJSON |
FlowFile JSON 콘텐츠 또는 지정된 FlowFile JSON 속성에 Jolt 변환 사양 목록을 적용합니다. |
JoltTransformRecord |
FlowFile 페이로드의 각 레코드에 JOLT 변환 사양을 적용합니다. |
JSLTTransformJSON |
FlowFile JSON 페이로드에 JSLT 변환을 적용합니다. |
JsonQueryElasticsearch |
Elasticsearch JSON DSL로 작성된 쿼리(집계 포함)를 실행할 수 있게 해주는 프로세서입니다. |
L
| 프로세서 | 설명 |
|---|---|
ListArchivedHubSpotData |
선택한 객체 유형에 대한 HubSpot의 보관된 데이터를 나열하고, 나열된 각 객체에 대해 해당 메타데이터를 FlowFile 속성으로 가진 하나의 FlowFile을 생성합니다. |
ListAzureBlobStorage_v12 |
Azure Blob Storage 컨테이너의 blob을 나열합니다. |
ListAzureDataLakeStorage |
Azure Data Lake Storage Gen 2 파일 시스템의 디렉터리를 나열합니다. |
ListBoxFile |
Box 폴더의 파일을 나열합니다. |
ListBoxFileInfo |
Box 폴더의 각 파일에 대한 파일 메타데이터를 가져옵니다. |
ListBoxFileMetadataInstances |
Box 파일과 연결된 모든 메타데이터 인스턴스를 조회합니다. |
ListBoxFileMetadataTemplates |
Box 파일과 연결된 모든 메타데이터 템플릿을 조회합니다. |
ListConfluenceGroups |
Confluence 그룹을 나열하는 프로세서입니다. |
ListDatabaseTables |
데이터베이스 연결의 테이블에 대한 메타데이터에 해당하는 속성을 각각 포함하는 Flow file 집합을 생성합니다. |
ListDBFSDirectory |
DBFS 디렉터리의 파일 이름을 나열하고 파일 이름과 함께 새 FlowFile을 출력합니다. |
ListDropbox |
Dropbox에서 파일 목록을 가져옵니다(바로가기는 무시). |
ListenFTP |
지정된 포트에서 수신하는 FTP 서버를 시작하고 들어오는 파일을 FlowFile로 변환합니다. |
ListenHTTP |
HTTP 서버를 시작하고 주어진 기본 경로에서 수신하여 들어오는 요청을 FlowFile로 변환합니다. |
ListenOTLP |
HTTP 또는 gRPC를 통해 OpenTelemetry 메시지를 수집합니다. |
ListenSlack |
하나 이상의 Slack 대화에서 실시간 메시지 또는 Slack 명령을 조회합니다. |
ListenSyslog |
TCP 또는 UDP를 통해 주어진 포트로 전송되는 Syslog 메시지를 수신합니다. |
ListenTCP |
들어오는 TCP 연결을 수신하고 줄 구분자를 메시지 구분자로 사용해 각 연결에서 데이터를 읽습니다. |
ListenUDP |
주어진 포트에서 Datagram Packet을 수신합니다. |
ListenUDPRecord |
주어진 포트에서 Datagram Packet을 수신하고 구성된 Record Reader를 사용해 각 데이터그램의 콘텐츠를 읽습니다. |
ListenWebSocket |
클라이언트 연결을 수락하는 WebSocket 서버 엔드포인트 역할을 합니다. |
ListFile |
입력 디렉터리에서 파일 목록을 가져옵니다. |
ListFTP |
FTP 서버에 있는 파일 목록을 수행합니다. |
ListGCSBucket |
GCS 버킷에서 객체 목록을 가져옵니다. |
ListGoogleDrive |
Google Drive 폴더에서 실제 파일 목록을 수행합니다(바로가기는 무시). |
ListGoogleDriveFileInfo |
지정된 Google Drive의 모든 파일과 폴더를 나열합니다. |
ListGoogleGroups |
Google Workspace에서 주어진 도메인의 모든 그룹을 나열합니다. |
ListHubSpotObjects |
지정된 객체 유형에 대한 HubSpot 데이터를 가져오고, 나열된 각 객체에 대해 해당 메타데이터를 FlowFile 속성으로 가진 하나의 FlowFile을 생성합니다. |
ListMicrosoftDataverseTables |
Microsoft Dataverse 환경에서 테이블을 나열합니다. |
ListS3 |
S3 버킷에서 객체 목록을 가져옵니다. |
ListSFDCDataShares |
식별된 사용자가 사용할 수 있는 조직의 사용 가능한 데이터 공유를 나열합니다. |
ListSFDCObjects |
식별된 사용자가 사용할 수 있는 조직의 사용 가능한 객체를 나열합니다. |
ListSFTP |
SFTP 서버에 있는 파일 목록을 수행합니다. |
ListSharepointDrives |
지정된 Sharepoint 사이트에 있는 각 Drive에 대해 FlowFile을 내보냅니다. |
ListSharepointSiteGroups |
지정된 SharePoint 사이트에서 사용 가능한 모든 SharePoint 사이트 그룹을 나열합니다. |
ListSmb |
SMB 프로토콜로 공유된 실제 파일을 나열합니다. |
ListTableNames |
모든 원본 테이블 이름을 가져와 가능한 구성 중 하나와 일치시킵니다: - regexp 표현식 등 |
ListUnityCatalogDirectory |
Unity Catalog 디렉터리의 파일 이름을 나열하고 파일 이름과 함께 새 FlowFile을 출력합니다. |
LogAttribute |
지정된 로그 레벨에서 FlowFile의 속성을 출력합니다. |
LogMessage |
지정된 로그 레벨에서 로그 메시지를 출력합니다. |
LookupAttribute |
조회 서비스에서 속성을 조회합니다. |
LookupRecord |
Record에서 하나 이상의 필드를 추출하고 LookupService에서 해당 필드의 값을 조회합니다. |
M
| 프로세서 | 설명 |
|---|---|
MergeContent |
사용자 정의 전략을 기반으로 FlowFile 그룹을 병합하고 단일 FlowFile로 패키징합니다. |
MergeRecord |
이 프로세서는 여러 레코드 기반 FlowFile을 입력 FlowFile의 모든 레코드를 포함하는 단일 FlowFile로 병합합니다. |
MergeSnowflakeJournalTable |
Snowflake에서 journal 테이블의 변경 사항을 대상 테이블로 병합하는 작업을 트리거합니다. |
ModifyBytes |
바이너리 파일의 시작과 끝의 바이트 범위 또는 전체 콘텐츠를 버립니다. |
ModifyCompression |
사용자 지정 압축 알고리즘으로 FlowFile 콘텐츠를 해제하고 지정된 압축 형식 속성으로 다시 압축하여 FlowFile 콘텐츠를 압축하는 데 사용되는 압축 알고리즘을 변경합니다. |
MonitorActivity |
흐름의 활동을 모니터링하고, 지정된 시간 동안 흐름에 데이터가 없으면 표시기를 보내고 흐름 활동이 복원되면 다시 표시기를 보냅니다. |
MoveAzureDataLakeStorage |
Azure Data Lake Storage Gen 2 내에서 콘텐츠를 이동합니다. |
N
| 프로세서 | 설명 |
|---|---|
Notify |
선택적으로 FlowFile 속성과 함께 해제 신호 식별자를 분산 캐시에 캐시합니다. |
O
| 프로세서 | 설명 |
|---|---|
OpenAiTranscribeAudio |
오디오를 영어 텍스트로 전사합니다. |
P
| 프로세서 | 설명 |
|---|---|
PackageFlowFile |
이 프로세서는 FlowFile 속성과 콘텐츠를 NiFi에서 내보내고 다시 NiFi로 가져올 수 있는 출력 FlowFile로 패키징해 원래 속성과 콘텐츠를 보존합니다. |
PaginatedJsonQueryElasticsearch |
Elasticsearch JSON DSL로 작성된 페이징된 쿼리(집계 포함)를 실행할 수 있게 해주는 프로세서입니다. |
ParseEvtx |
Windows 이벤트 로그 파일(evtx)의 콘텐츠를 파싱하고 결과 XML을 FlowFile에 기록합니다. |
ParseExcelCellReference |
Excel 셀 참조 수식을 파싱하는 프로세서입니다. |
ParseSyslog |
RFC5424 및 RFC3164 형식에 따라 Syslog 메시지의 콘텐츠를 파싱하려 시도하고 Syslog 메시지의 각 부분에 대해 FlowFile에 속성을 추가합니다. |
ParseSyslog5424 |
RFC5424 형식에 따라 잘 형성된 Syslog 메시지의 콘텐츠를 파싱하려 시도하고 Structured Data를 포함해 Syslog 메시지의 각 부분에 대해 FlowFile에 속성을 추가합니다. |
PartitionRecord |
구성된 데이터 필드를 기반으로 레코드 기반 데이터를 분할하거나 파티션합니다. |
PerformSnowflakeCortexOCR |
Snowflake Cortex ML 함수를 사용해 PDF 문서에 대한 광학 문자 인식(OCR)을 수행합니다. |
PickTablesForReplication |
정규화된 테이블 이름 목록을 받아 테이블이 - 새 것인지(복제되지 않았지만 소스에 추가됨) - 기존 것인지(복제되고 소스에 존재함) - 오래된 것인지(복제되었지만 소스에 더 이상 존재하지 않음) 판단합니다. 구성은 FlowFile 속성으로 전달됩니다. |
PromptAnthropicAI |
Anthropic에 프롬프트를 보내고 응답을 FlowFile 속성 또는 들어오는 FlowFile 콘텐츠로 기록합니다. |
PromptAzureOpenAI |
Azure의 OpenAI 서비스에 프롬프트를 보내고 응답을 FlowFile 속성 또는 들어오는 FlowFile 콘텐츠로 기록합니다. |
PromptLLM |
이 프로세서는 사용자 정의 프롬프트를 대규모 언어 모델(LLM)에 보내 응답하게 합니다. |
PromptOpenAI |
OpenAI에 프롬프트를 보내고 응답을 FlowFile 속성 또는 들어오는 FlowFile 콘텐츠로 기록합니다. |
PromptSnowflakeCortex |
Snowflake Cortex에 프롬프트를 보내고 응답을 FlowFile 속성 또는 들어오는 FlowFile 콘텐츠로 기록합니다. |
PromptVertexAI |
VertexAI에 프롬프트를 보내고 응답을 FlowFile 속성 또는 들어오는 FlowFile 콘텐츠로 기록합니다. |
PublishAMQP |
FlowFile 콘텐츠에서 AMQP 메시지를 생성하고 AMQP Exchange에 메시지를 보냅니다. |
PublishChangeDataSnowpipeStreaming |
Snowpipe Streaming High Availability와 동시성 그룹 직렬화를 사용해 변경 데이터를 Newline Delimited JSON으로 Snowflake Database Pipes에 게시합니다. |
PublishGCPubSub |
들어오는 FlowFile의 콘텐츠를 구성된 Google Cloud PubSub 토픽에 게시합니다. |
PublishJMS |
FlowFile 콘텐츠에서 JMS 메시지를 생성하고 JMS BytesMessage 또는 TextMessage로 JMS Destination(큐 또는 토픽)에 보냅니다. |
PublishKafka |
FlowFile의 콘텐츠를 Kafka Producer API를 사용해 메시지 또는 개별 레코드로 Apache Kafka에 보냅니다. |
PublishMQTT |
MQTT 토픽에 메시지를 게시합니다. |
PublishSlack |
지정된 Slack 채널에 메시지를 게시합니다. |
PublishSnowpipeStreaming |
Snowpipe Streaming High Availability를 사용해 Newline Delimited JSON을 Snowflake Database Pipes에 게시합니다. |
PutAzureBlobStorage_v12 |
Azure Blob Storage의 blob에 콘텐츠를 넣습니다. |
PutAzureCosmosDBRecord |
이 프로세서는 Core SQL API로 Cosmos DB에 데이터를 삽입하는 레코드 인식(record-aware) 프로세서입니다. |
PutAzureDataExplorer |
제공된 엔드포인트로 FlowFile을 보내는 Azure Data Explorer 싱크 역할을 합니다. |
PutAzureDataLakeStorage |
FlowFile의 콘텐츠를 Azure Data Lake Storage Gen 2의 파일로 기록합니다. |
PutAzureEventHub |
FlowFile 콘텐츠를 Azure Event Hubs로 보냅니다. |
PutAzureQueueStorage_v12 |
들어오는 FlowFile의 콘텐츠를 구성된 Azure Queue Storage에 기록합니다. |
PutBigQuery |
FlowFile의 콘텐츠를 Google BigQuery 테이블에 기록합니다. |
PutBoxFile |
Box 폴더에 콘텐츠를 넣습니다. |
PutCloudWatchMetric |
Amazon CloudWatch에 지표를 게시합니다. |
PutDatabaseRecord |
PutDatabaseRecord 프로세서는 지정된 RecordReader를 사용해 들어오는 Flow file에서 (여러) 레코드를 입력합니다. |
PutDatabricksSQL |
Databricks REST API를 사용해 SQL 실행을 제출한 다음 JSON 응답을 FlowFile 콘텐츠에 기록합니다. |
PutDBFSFile |
FlowFile 콘텐츠를 DBFS에 기록합니다. |
PutDistributedMapCache |
FlowFile의 콘텐츠를 가져와 FlowFile 속성에서 계산된 캐시 키를 사용해 분산 맵 캐시에 넣습니다. |
PutDropbox |
Dropbox 폴더에 콘텐츠를 넣습니다. |
PutDynamoDB |
해시 및 범위 키를 기반으로 DynamoDB에 문서를 넣습니다. |
PutDynamoDBRecord |
레코드 기반 데이터를 기반으로 DynamoDB에 항목을 삽입합니다. |
PutElasticsearchJson |
공식 Elastic REST 클라이언트 라이브러리를 사용하는 Elasticsearch put 프로세서입니다. |
PutElasticsearchRecord |
공식 Elastic REST 클라이언트 라이브러리를 사용하는 레코드 인식(record-aware) Elasticsearch put 프로세서입니다. |
PutEmail |
각 들어오는 FlowFile에 대해 구성된 수신자에게 이메일을 보냅니다. |
PutFile |
FlowFile의 콘텐츠를 로컬 파일 시스템에 기록합니다. |
PutFTP |
FlowFile을 FTP 서버로 보냅니다. |
PutGCSObject |
FlowFile의 콘텐츠를 Google Cloud Storage의 객체로 기록합니다. |
PutGoogleDrive |
FlowFile의 콘텐츠를 Google Drive의 파일로 기록합니다. |
PutGridFS |
GridFS 버킷에 파일을 기록합니다. |
PutHubSpot |
HubSpot 객체를 upsert합니다. |
PutIcebergTable |
네임스페이스와 테이블 관리를 위한 구성 가능한 Catalog를 사용해 Iceberg에 레코드를 저장합니다. |
PutKinesisFirehose |
콘텐츠를 지정된 Amazon Kinesis Firehose로 보냅니다. |
PutKinesisStream |
콘텐츠를 지정된 Amazon Kinesis로 보냅니다. |
PutLambda |
콘텐츠를 지정된 Amazon Lambda Function으로 보냅니다. |
PutMongo |
FlowFile의 콘텐츠를 MongoDB에 기록합니다. |
PutMongoBulkOperations |
FlowFile의 콘텐츠를 MongoDB에 bulk-update로 기록합니다. |
PutMongoRecord |
이 프로세서는 MongoDB에 데이터를 삽입/upsert하는 레코드 인식(record-aware) 프로세서입니다. |
PutRecord |
PutRecord 프로세서는 지정된 RecordReader를 사용해 들어오는 Flow file에서 (여러) 레코드를 입력하고 Record Destination Service로 지정된 대상으로 보냅니다. |
PutRedisHashRecord |
지정된 해시 값을 사용해 Redis에 레코드 필드 데이터를 넣습니다. 해시 값은 각 레코드에서 해시 값을 포함하는 필드에 대한 RecordPath로 결정됩니다. |
PutS3Object |
FlowFile의 콘텐츠를 Amazon S3 버킷의 S3 객체로 기록합니다. |
PutSalesforceObject |
지정된 Salesforce sObject에 대해 새 레코드를 생성합니다. |
PutSFTP |
FlowFile을 SFTP 서버로 보냅니다. |
PutSmbFile |
FlowFile의 콘텐츠를 Samba 네트워크 위치에 기록합니다. |
PutSnowflakeInternalStageFile |
Snowflake 내부 스테이지에 파일을 넣습니다. |
PutSnowpipeStreaming |
레코드를 Snowflake 테이블로 스트리밍합니다. |
PutSNS |
FlowFile의 콘텐츠를 Amazon Simple Notification Service에 알림으로 보냅니다. |
PutSplunk |
TCP, TCP + TLS/SSL 또는 UDP를 통해 로그를 Splunk Enterprise로 보냅니다. |
PutSplunkHTTP |
HTTP 또는 HTTPS를 통해 Flow file 콘텐츠를 지정된 Splunk 서버로 보냅니다. |
PutSQL |
SQL UPDATE 또는 INSERT 명령을 실행합니다. |
PutSQS |
Amazon Simple Queuing Service 큐에 메시지를 게시합니다. |
PutSyslog |
TCP 또는 UDP를 통해 주어진 호스트와 포트에 Syslog 메시지를 보냅니다. |
PutTCP |
선택적 TLS 지원과 함께 직렬화된 FlowFile 또는 레코드를 TCP를 통해 구성 가능한 대상으로 보냅니다. |
PutUDP |
PutUDP 프로세서는 FlowFile을 수신하고 FlowFile 콘텐츠를 단일 UDP 데이터그램 패킷으로 패키징한 다음 구성된 UDP 서버로 전송합니다. |
PutUnityCatalogFile |
최대 크기 5 GiB의 FlowFile 콘텐츠를 Unity Catalog에 기록합니다. |
PutVectaraDocument |
JSON 문서를 생성해 Vectara의 업로드 엔드포인트에 업로드합니다. |
PutVectaraFile |
FlowFile 콘텐츠를 Vectara의 인덱스 엔드포인트에 업로드합니다. |
PutWebSocket |
ListenWebSocket 또는 ConnectWebSocket으로 설정된 WebSocket 세션을 사용해 메시지를 WebSocket 원격 엔드포인트로 보냅니다. |
PutZendeskTicket |
Zendesk API를 사용해 Zendesk 티켓을 생성합니다. |
Q
| 프로세서 | 설명 |
|---|---|
QueryAzureDataExplorer |
Azure Data Explorer를 쿼리하고 JSON 결과를 출력 FlowFile로 스트리밍합니다. |
QueryDatabaseTable |
SQL select 쿼리를 생성하거나 제공된 문을 사용해, 지정된 Maximum Value 열의 값이 이전에 보았던 최댓값보다 큰 모든 행을 가져오도록 실행합니다. |
QueryDatabaseTableRecord |
SQL select 쿼리를 생성하거나 제공된 문을 사용해, 지정된 Maximum Value 열의 값이 이전에 보았던 최댓값보다 큰 모든 행을 가져오도록 실행합니다. |
QueryMilvus |
벡터를 사용해 Milvus 데이터베이스의 주어진 컬렉션을 쿼리합니다. |
QueryPinecone |
입력 벡터와 유사한 벡터를 Pinecone에서 쿼리하거나 ID로 벡터를 조회합니다. |
QueryRecord |
FlowFile의 콘텐츠에 대해 하나 이상의 SQL 쿼리를 평가합니다. |
QuerySalesforceObject |
Salesforce sObject에서 레코드를 조회합니다. |
QuerySplunkIndexingStatus |
인덱싱 확인 상태를 얻기 위해 Splunk 서버를 쿼리합니다. |
R
| 프로세서 | 설명 |
|---|---|
RemoveRecordField |
Record 지향 데이터를 포함하는 FlowFile의 콘텐츠를 수정합니다. |
RenameRecordField |
FlowFile의 각 레코드에서 하나 이상의 필드 이름을 변경합니다. |
ReplaceText |
FlowFile 콘텐츠에서 FlowFile 콘텐츠의 일부 텍스트 값(정규식 또는 리터럴 값)을 검색하고 일치하는 콘텐츠 섹션을 대체 값으로 교체해 FlowFile의 콘텐츠를 업데이트합니다. |
ReplaceTextWithMapping |
FlowFile에 대해 정규식을 평가하고 정규식과 일치하는 콘텐츠 섹션을 매핑 파일에 제공된 대체 값으로 교체해 FlowFile의 콘텐츠를 업데이트합니다. |
RetryFlowFile |
이 프로세서로 전달된 FlowFile의 'Retry Attribute' 값이 구성된 'Maximum Retries' 값과 비교 확인됩니다. |
RouteOnAttribute |
Attribute Expression Language를 사용해 속성에 따라 FlowFile을 라우팅합니다. |
RouteOnContent |
FlowFile의 콘텐츠에 정규식을 적용하고 정규식이 일치하는 각 대상에 FlowFile 복사본을 라우팅합니다. |
RouteText |
사용자 정의 규칙 집합을 기반으로 텍스트 데이터를 라우팅합니다. |
RunDatabricksJob |
사용자 지정 매개변수로 미리 정의된 Databricks 작업을 트리거합니다. |
RunMongoAggregation |
FlowFile이 수신될 때마다 집계 쿼리를 실행하는 프로세서입니다. |
S
| 프로세서 | 설명 |
|---|---|
SampleRecord |
지정된 샘플링 전략(예: Reservoir Sampling)에 따라 FlowFile의 레코드를 샘플링합니다. |
ScanAttribute |
FlowFile의 지정된 속성을 스캔하여 그 값 중 일부가 지정된 용어 사전에 존재하는지 확인합니다. |
ScanContent |
사용자가 제공한 사전에서 발견되는 용어에 대해 FlowFile의 콘텐츠를 스캔합니다. |
ScriptedFilterRecord |
이 프로세서는 사용자가 제공한 스크립트로 FlowFile에서 레코드를 필터링하는 기능을 제공합니다. |
ScriptedPartitionRecord |
Record 지향 데이터를 수신합니다. |
ScriptedTransformRecord |
들어오는 FlowFile의 각 레코드에 대해 간단한 스크립트를 평가하는 기능을 제공합니다. |
ScriptedValidateRecord |
이 프로세서는 사용자가 제공한 스크립트로 FlowFile의 레코드를 검증하는 기능을 제공합니다. |
SearchElasticsearch |
Elasticsearch JSON DSL로 작성된 페이징된 쿼리(집계 포함)를 반복 실행할 수 있게 해주는 프로세서입니다. |
SegmentContent |
FlowFile을 바이트 경계에서 여러 개의 작은 세그먼트로 분할합니다. |
SignContentPGP |
OpenPGP 개인 키를 사용해 콘텐츠에 서명합니다. |
SnowflakeDetectDuplicate |
FlowFile의 해시(FlowFile 속성으로 제공)가 이미 Snowflake 테이블에 있는지 확인하고, 있으면 FlowFile을 'duplicate'로, 없으면 'distinct'로, 오류 시 'failure'로 라우팅합니다. |
SplitAvro |
구성된 Output Size에 따라 바이너리 인코딩된 Avro 데이터 파일을 더 작은 파일로 분할합니다. |
SplitContent |
지정된 바이트 시퀀스로 들어오는 FlowFile을 분할합니다. |
SplitExcel |
이 프로세서는 다중 시트 Microsoft Excel 스프레드시트를 여러 개의 Microsoft Excel 스프레드시트로 분할하며, 원본 파일의 각 시트가 자체 Flow file의 개별 스프레드시트로 변환됩니다. |
SplitJson |
JsonPath 표현식으로 지정된 배열 요소에 대해 JSON 파일을 여러 개의 별도 FlowFile로 분할합니다. |
SplitRecord |
레코드 지향 데이터 형식의 입력 FlowFile을 여러 개의 더 작은 FlowFile로 분할합니다. |
SplitText |
행 경계에서 텍스트 파일을 최대 행 수 또는 조각 총 크기로 제한된 여러 개의 더 작은 텍스트 파일로 분할합니다. |
SplitXml |
XML 파일을 원래 루트 요소의 자식 또는 하위 요소 각각으로 구성된 여러 개의 별도 FlowFile로 분할합니다. |
StartAwsPollyJob |
AWS Polly 작업을 트리거합니다. |
StartAwsTextractJob |
AWS Textract 작업을 트리거합니다. |
StartAwsTranscribeJob |
AWS Transcribe 작업을 트리거합니다. |
StartAwsTranslateJob |
AWS Translate 작업을 트리거합니다. |
StartGcpVisionAnnotateFilesOperation |
파일 입력에 대한 Vision 작업을 트리거합니다. |
StartGcpVisionAnnotateImagesOperation |
이미지 입력에 대한 Vision 작업을 트리거합니다. |
SubmitQueryJob |
Bulk API 2를 사용해 Salesforce에 Query Job을 제출합니다. |
SummarizeText |
이 프로세서는 대규모 언어 모델(LLM)을 사용해 FlowFile의 콘텐츠를 요약합니다. |
T
| 프로세서 | 설명 |
|---|---|
TagS3Object |
Amazon S3 객체에 태그를 추가하거나 업데이트합니다. |
TailFile |
파일 또는 파일 목록을 "tail"하여 파일에 기록되는 대로 데이터를 수집합니다. |
TransformXml |
제공된 XSLT 파일을 FlowFile XML 페이로드에 적용합니다. |
U
| 프로세서 | 설명 |
|---|---|
UnpackContent |
여러 패키징 형식 중 하나로 패키징된 FlowFile의 콘텐츠를 풀고 각 입력 FlowFile에 대해 하나에서 여러 개의 FlowFile을 내보냅니다. |
UpdateAttribute |
Attribute Expression Language를 사용해 FlowFile의 속성을 업데이트하고/하거나 정규식에 따라 속성을 삭제합니다. |
UpdateBoxFileMetadataInstance |
주어진 FlowFile의 레코드를 사용해 Box 파일의 메타데이터 템플릿 값을 업데이트합니다. |
UpdateBulkJobState |
특정 객체 유형에 대해 공유 상태 서비스에서 Salesforce Bulk Job의 상태를 업데이트합니다. |
UpdateByQueryElasticsearch |
쿼리를 사용해 Elasticsearch 인덱스의 문서를 업데이트합니다. |
UpdateCounter |
이 프로세서는 사용자가 흐름에서 특정 카운터와 핵심 지점을 설정할 수 있게 해줍니다. |
UpdateDatabaseTable |
이 프로세서는 JDBC 연결과 들어오는 레코드를 사용해 들어오는 레코드를 지원하는 데 필요한 데이터베이스 테이블 변경을 생성합니다. |
UpdateRecord |
Record 지향 데이터를 포함하는 FlowFile의 콘텐츠를 업데이트합니다. |
UpdateSnowflakeDatabase |
들어오는 FlowFile에 제공된 스키마를 기반으로 Snowflake 테이블 정의를 업데이트합니다. |
UpdateSnowflakeIcebergDatabase |
Snowflake Iceberg 테이블 정의를 업데이트합니다. |
UpdateSnowflakeSchema |
Snowflake 데이터베이스 스키마가 없으면 생성합니다. |
UpdateSnowflakeStream |
구성된 작업에 따라 Snowflake 스트림을 생성, 삭제 또는 교체하여 관리합니다. |
UpdateSnowflakeTable |
들어오는 FlowFile에 제공된 스키마를 기반으로 Snowflake 테이블 정의를 업데이트합니다. |
UpdateSnowflakeView |
들어오는 FlowFile에 제공된 열 매핑을 기반으로 Snowflake 뷰를 생성하거나 교체합니다. |
UpdateTableState |
Table State Service에서 테이블의 상태를 업데이트합니다. |
UpsertMilvus |
주어진 컬렉션에 대해 Milvus 데이터베이스에 벡터를 upsert합니다. |
UpsertPinecone |
메타데이터와 선택적 텍스트를 포함한 벡터를 Pinecone 인덱스에 게시합니다. |
UpsertSFDCObjects |
들어오는 FlowFile의 레코드를 Salesforce에 upsert합니다. |
V
| 프로세서 | 설명 |
|---|---|
ValidateCsv |
FlowFile의 콘텐츠 또는 FlowFile 속성 값을 사용자 지정 CSV 스키마에 대해 검증합니다. |
ValidateJson |
FlowFile의 콘텐츠를 구성 가능한 JSON Schema에 대해 검증합니다. |
ValidateRecord |
들어오는 FlowFile의 레코드를 주어진 스키마에 대해 검증합니다. |
ValidateXml |
FlowFile에 포함된 XML을 검증합니다. |
VerifyContentMAC |
제공된 Secret Key를 사용해 Message Authentication Code를 계산하고 제공된 MAC 속성과 비교합니다. |
VerifyContentPGP |
OpenPGP 공개 키를 사용해 서명을 검증합니다. |
W
| 프로세서 | 설명 |
|---|---|
Wait |
해당 Notify 프로세서의 분산 캐시에 일치하는 해제 신호가 저장될 때까지 들어오는 FlowFile을 'wait' 관계로 라우팅합니다. |
WaitForTableState |
해당 테이블 상태가 수락된 상태와 같지 않을 때까지 들어오는 FlowFile을 차단합니다. |