LangSmith Engine 보안
LangSmith Engine 보안
LangSmith Engine이 데이터를 처리하는 방법, 접근을 통제하는 GitHub 및 모델 하위 처리자 컨트롤, 그리고 컴플라이언스 태세에 대해 설명해요.
LangSmith Engine은 LangSmith에 내장된 AI 에이전트로, 여러분이 만든 에이전트를 개선해요. Engine은 이미 LangSmith에 있는 트레이스 데이터를 검토하고, 이슈를 표면화하고 우선순위를 매기며, 제안된 수정 사항, 제안된 프롬프트 변경, 평가가 포함된 풀 리퀘스트를 열어요. 제품 개요는 Engine을 참고하세요.
Engine은 옵트인(opt-in)이며 조언적(advisory)이고, 여러분의 데이터로 학습하지 않으며, LangSmith의 SOC 2 Type II 및 ISO 27001 컨트롤 아래에서 실행돼요. 이 페이지는 Engine이 데이터를 처리하는 방법, GitHub 및 모델 접근을 통제하는 컨트롤, 그리고 LangSmith Cloud에서 Engine의 컴플라이언스 태세를 설명해요. 셀프 호스팅 배포에서 Engine이 실행되는 방법은 셀프 호스팅의 Engine을 참고하세요.
Engine은 LangSmith의 일부로 제공되며, 다음 섹션에서 설명하는 AI 추론 계층을 다루는 추가 컨트롤과 함께 LangSmith의 보안 및 컴플라이언스 태세를 물려받아요. Engine은 절대 기본으로 켜지지 않으며, 모든 요금제 조직에서 조직 관리자만 활성화할 수 있어요. 데이터 암호화와 지역 처리를 포함한 LangSmith 플랫폼 수준 컨트롤은 Regions FAQ와 LangChain Trust Center를 참고하세요.
출처: 문서
본문
Engine이 사용하는 데이터
Engine은 이미 LangChain과 공유하기로 선택한 데이터, 즉 LangSmith에 보내는 트레이스 데이터와, 별도로 LangChain 관리 GitHub App을 통해 부여한 GitHub 저장소 콘텐츠(아래 GitHub 통합 참고)를 대상으로 작동해요. Engine 활성화는 다른 고객 데이터 소스를 도입하지 않아요. 다음 표는 Engine이 읽는 것, 그것이 있는 곳, 그리고 그것이 가능하게 하는 것을 요약해요.
| 데이터 소스 | Engine이 읽는 것 | 저장 및 영속성 | 가능하게 하는 것 |
|---|---|---|---|
| LangSmith 워크스페이스 콘텐츠 | LangSmith에 저장한 트레이스 데이터 및 프롬프트, 평가자 같은 기타 워크스페이스 콘텐츠. | LangSmith 테넌트 내. 트레이스 보존은 2026년 9월 14일 기준 SaaS 고객의 경우 14일(기본) 또는 최대 180일(연장)이며 프로젝트별로 선택됨. | 이슈 감지, 우선순위 지정, 평가 제안. |
| GitHub 저장소 | 연결한 저장소의 소스 코드 및 저장소 컨텍스트 (아래 GitHub 통합 참고). | 각 분석 런 기간 동안 격리된 LangChain 관리 샌드박스 안에서 처리된 후 폐기됨. | 제안된 코드 수정이 포함된 풀 리퀘스트 작성. |
| 모델 프로바이더 (추론) | 각 분석 작업에 필요한 콘텐츠만. | 각 Engine 모델 프로바이더와 기록 보존 없음(zero data retention)으로 구성됨 (아래 모델 하위 처리자 참고). | Engine 추론 및 생성. |
Engine의 읽기 범위는 시간이 지나면서 확장될 수 있어요. 이 페이지는 중요한 변경 사항을 반영하도록 업데이트돼요. 마지막 검토 2026년 9월 16일.
Engine에 보내는 트레이스 콘텐츠는 사용자 메시지, 도구 출력, PII를 포함할 수 있으며, 이 콘텐츠는 각 분석 작업의 기록 보존 없음 조건으로 모델 하위 처리자에게 전송돼요. 민감한 필드를 트레이스가 LangSmith에 도달하기 전에 제거하려면 클라이언트 측 마스킹을 사용하세요.
Engine 출력은 조언적이에요. 이슈를 표면화하고 추적하며, 풀 리퀘스트를 제안하고, 오프라인 평가용 데이터셋 예시를 추천해요. 무엇이 출시될지는 엔지니어와 브랜치 보호 및 리뷰 정책이 결정해요.
GitHub 통합
Engine은 LangChain 관리 GitHub App을 통해 소스 코드에 연결해요. GitHub.com만 지원돼요. GitLab, Bitbucket 및 기타 버전 관리 프로바이더는 아직 지원되지 않아요.
App은 다음으로 범위가 지정돼요:
- 설치할 때 선택한 저장소에 대한 읽기 접근.
- 만드는 새 브랜치에서 풀 리퀘스트를 여는 쓰기 접근. 기존 브랜치로의 푸시는 브랜치 보호 규칙에 따라 관리돼요.
접근은 GitHub의 표준 App 모델을 사용해요: 모든 작업은 1시간 후 만료되는 단기 설치 토큰을 통해 실행되며, 설치 시 부여된 권한을 초과할 수 없고 선택하지 않은 저장소에 도달할 수 없어요. 토큰은 상시 자격 증명으로 보관되지 않고 분석 런마다 발급돼요.
소스 코드는 Engine의 자동화된 분석만 읽으며 정상 운영 중에는 LangChain 직원이 탐색하지 않아요. 각 런에 대해 선택된 저장소는 격리되고 네트워크가 제한된 샌드박스에 복제되고, 그 런에만 사용되며, 런이 완료되면 삭제돼요(런이 중단되면 최대 1시간 이내). 분석에 대한 Engine 자체의 운영 트레이스는 기본적으로 마스킹돼요.
언제든지 GitHub 조직에서 App을 제거해 Engine의 GitHub 접근을 철회할 수 있어요.
모델 하위 처리자
LangSmith Cloud에서 Engine의 모델 하위 처리자(현재 OpenAI, Anthropic, Fireworks, Baseten)는 기록 보존 없음으로 구성되고, LangChain과의 계약에 따라 고객 데이터를 모델 학습이나 파인튜닝에 사용하는 것이 금지돼요. LangChain Trust Center가 권위 있는 하위 처리자 목록을 게시해요.
셀프 호스팅 배포에서 Engine은 LangSmith Intelligence(LSI)를 통해 클라우드의 모델 프로바이더를 사용해요. AWS에서는 Amazon Bedrock을, GCP에서는 Vertex AI를 사용해요.
Engine은 BYOK(자체 키 가져오기)를 지원하지 않아요.
주요 보안 컨트롤
Engine은 LangSmith 기준선 위에 다음 컨트롤을 추가해요:
- 명시적 옵트인: Engine은 절대 기본으로 켜지지 않으며 조직 관리자만 활성화할 수 있어요.
- 조언적 출력, 인간이 주도: Engine은 자동 병합, 자동 배포 또는 시스템에 대한 파괴적 조치를 하지 않아요. 모든 제안된 변경은 브랜치 보호, 리뷰, 병합 정책을 따르는 풀 리퀘스트예요. 제안된 프롬프트 변경은 LangSmith의 별도 제안 레코드에 기록되며, 권한 있는 사용자가 명시적으로 적용하기 전까지 어떤 프롬프트도 수정하지 않아요. 두 경로 모두에서 무엇이 출시될지는 인간이 결정해요.
- 각 Engine 모델 프로바이더와 구성된 기록 보존 없음: 프롬프트와 완료는 요청 이후 추론 공급업체가 영구화하지 않아요.
- 모델 학습/파인튜닝에 고객 데이터 미사용: 각 프로바이더는 계약에 따라 고객 콘텐츠를 학습에 사용하지 않도록 구속돼요.
- 논리적 테넌트 격리: Engine의 데이터 접근은 LangSmith 테넌트로 범위가 지정돼요. 테넌트 간 접근은 LangSmith Cloud의 테넌시 모델과 일치하는 애플리케이션 수준 컨트롤로 방지돼요. 각 분석 런은 자체 격리 샌드박스 안에서 실행돼요.
- 감사 가능성: Engine은 작업을 GitHub 풀 리퀘스트로 표면화하고, Engine 탭의 이슈 목록에 근거 컨텍스트를 제공해요. 코드 변경은 브랜치 보호, 리뷰, 자동화된 빌드 컨트롤을 통과하므로, 소프트웨어 개발 수명 주기가 무엇이 출시되는지에 대한 기록 시스템으로 남아요.
- 클라이언트 측 PII 스크러빙: LangSmith의 클라이언트 라이브러리는 민감한 콘텐츠가 LangSmith에 전송되기 전에 트레이스에서 제거할 수 있어요. 규제 데이터를 처리하는 고객에게 권장돼요.
- LangChain이 관리하는 모델 선택: LangChain은 이러한 하위 처리자들 사이에서 각 Engine 작업에 사용할 특정 모델을 선택하며, 별도 알림 없이 그 세트 내에서 선택을 변경할 수 있어요. 새 하위 처리자 추가는 표준 하위 처리자 변경 알림 프로세스를 따릅니다.
- 철회 및 삭제: App을 제거해 언제든지 GitHub 접근을 철회하고, Engine 설정에서 Delete all issues로 Engine의 결과를 제거할 수 있어요. 트레이스 데이터는 LangSmith의 보존 및 정리 설정을 따릅니다.
컴플라이언스 태세
Engine은 SOC 2 Type II로 매년 감사되고 ISO 27001로 인증된 LangSmith의 컨트롤 환경 아래에서 운영돼요. Engine의 모델 하위 처리자는 LangChain Trust Center에 나열되며, 이것이 조달 및 데이터 보호 영향 평가의 권위 있는 소스예요.
AI 고유 위험 및 완화
다음 위험은 AI 지원 코드 생성에 내재적이에요. LangChain은 제품에서 각각을 완화하며, 코드 리뷰 워크플로가 두 번째 방어선을 제공해요.
- 부정확하거나 환각된 제안: 코드가 배포되기 전에 모든 Engine 출력은 일반 풀 리퀘스트 리뷰와 자동화된 체크를 통과해요.
- 트레이스 콘텐츠를 통한 프롬프트 주입: 트레이스 데이터에는 웹 도구 출력 같은 외부 소스에서 반영된 적대적 콘텐츠가 포함될 수 있어요. Engine이 그러한 트레이스에서 만든 모든 제안은 코드가 배포되기 전에 여전히 인간 풀 리퀘스트 리뷰를 통과해요. 신뢰할 수 없는 소스의 트레이스는 주의해서 다루세요.
- 범위 밖 결정: Engine은 트레이스와 연결된 저장소만 추론해요. 티켓 시스템의 비즈니스 규칙 변경 같은 Engine이 볼 수 없는 컨텍스트에 의존하는 이슈는 인간의 책임으로 남아요.
더 알아보기
- Engine
- Engine 구성
- 셀프 호스팅의 Engine
- Engine 웹훅
- 트레이스에서 민감한 데이터 로깅 방지
- 컴플라이언스를 위한 데이터 정리
- 감사 로그
- Regions FAQ
- LangChain Trust Center
문의
보안 질문은 [email protected]로 문의하세요.