Azure Data Explorer sink 커넥터
Azure Data Explorer sink 커넥터
Azure Data Explorer(ADX) sink 커넥터는 Pulsar 토픽에서 메시지를 가져와 ADX 클러스터로 보내요. Pulsar 이벤트를 Azure의 시계열 분석 서비스에 적재하고 싶을 때 사용해요.
모든 Pulsar 커넥터는 다운로드 페이지에서 내려받을 수 있어요. 사용 전에 아래 설정 속성과 예시 구성을 확인해 두세요.
출처: 문서
본문
알아두기: 모든 Pulsar 커넥터는 다운로드 페이지에서 다운로드할 수 있어요.
Azure Data Explorer(ADX) sink 커넥터는 Pulsar 토픽에서 메시지를 가져와 ADX 클러스터로 보내요.
구성 (Configuration)
ADX sink 커넥터의 구성은 다음 속성을 가져요.
속성 (Property)
| 이름 | 타입 | 필수 | 기본값 | 설명 |
|---|---|---|---|---|
| clusterUrl | String | true | (빈 문자열) | ADX 클러스터 URL. |
| database | String | true | (빈 문자열) | 데이터를 수집(ingest)할 데이터베이스 이름. |
| table | String | true | (빈 문자열) | pulsar 데이터를 수집할 테이블 이름. |
| appId | String | false | (빈 문자열) | 인증용 AAD 앱 Id. |
| appKey | String | false | (빈 문자열) | 인증용 AAD 앱 시크릿. |
| tenantId | String | false | (빈 문자열) | 인증용 테넌트 Id. |
| managedIdentityId | String | false | (빈 문자열) | 인증용 Managed Identity 자격 증명. 사용자 할당 MI의 경우 clientId로, 시스템 할당 관리 ID의 경우 'system'으로 설정해요. |
| mappingRefName | String | false | (빈 문자열) | 수집용 매핑 참조. |
| mappingRefType | String | false | (빈 문자열) | 제공된 매핑 참조의 타입 (예: CSV, JSON 등). |
| flushImmediately | Boolean | false | false | 집계 없이 즉시 플러시(flush)할지 여부. 프로덕션 워크로드에서는 flushImmediately를 활성화하지 않는 것이 좋아요. |
| batchSize | Int | false | 100 | 배칭 시, ADX로 데이터를 보내기 전에 모아둘 레코드 수를 정의해요. |
| batchTimeMs | Long | false | 10000 | 배칭 시, ADX로 보내기 전에 레코드를 보관할 시간(ms). |
| maxRetryAttempts | Int | false | 1 | 일시적인 수집 오류 시 최대 재시도 횟수. |
| retryBackOffTime | Long | false | 10 | 일시적 오류에 대해 재시도 전 백오프할 시간(밀리초). |
예시 (Example)
ADX sink 커넥터를 사용하기 전에 다음 방법 중 하나로 구성 파일을 만들어야 해요.
JSON:
{
"configs": {
"clusterUrl":"https://somecluster.eastus.kusto.windows.net",
"database":"somedb",
"table": "tableName",
"appId": "xxxx-xxxx-xxxx-xxxx",
"appKey": "xxxx-xxxx-xxxx-xxxx",
"tenantId": "xxxx-xxxx-xxxx-xxxx",
"mappingRefName": "mapping ref name",
"mappingRefType":"CSV",
"flushImmediately":true,
"batchSize":100,
"batchTimeMs":10000,
}
}
YAML:
configs:
clusterUrl: https://somecluster.eastus.kusto.windows.net,
database: somedb,
table: tableName,
appId: xxxx-xxxx-xxxx-xxxx,
appKey: xxxx-xxxx-xxxx-xxxx,
tenantId: xxxx-xxxx-xxxx-xxxx,
mappingRefName: mapping ref name,
mappingRefType: CSV,
flushImmediately: true,
batchSize: 100,
batchTimeMs: 10000,
더 알아보기 (Learn more)
- sink 커넥터 실행 방법은 소스·sink 문서를 참고해요.
- 다른 커넥터 목록은 Pulsar IO 커넥터 문서에서 확인할 수 있어요.
- Azure Data Explorer 설정이 궁금하다면 Azure 공식 문서를 참고해요.