데이터 유출 방지

데이터 유출 방지

LLM 애플리케이션에서 개인정보가 어떻게 새어나가는지 한 번쯤 고민해보셨을 거예요. 사용자가 자기나 다른 사람의 PII를 입력하거나, RAG(검색 증강 생성) 방식으로 문서에서 PII가 담긴 내용을 꺼내 다른 사용자에게 공유하거나, 애플리케이션을 지원하는 제3자 LLM 제공업체에 고객 PII가 전달되는 경우가 대표적이에요. Lakera AI Guardrails의 데이터 유출 방지는 LLM 입력과 출력에서 개인식별정보(PII), 시스템 프롬프트, 트리거 단어, 커스텀 엔티티 유형을 검사해 상호작용을 차단하거나 민감 정보를 마스킹해줘요. 특히 제3자 LLM 제공업체로 보내지는 사용자 PII를 막는 데도 유용해요.

출처: Data Leakage Prevention 공식 문서

검사 지점 확장

Guard API 요청에 도구 호출(tool 역할 메시지)까지 포함하면, 정책에 따라 구성된 데이터 유출 감지기가 이 상호작용 지점에도 함께 적용돼요. 에이전트가 도구 결과를 주고받는 흐름에서도 데이터 유출을 막으려면 Agent Behavior Defense와 Guard API의 에이전트·도구 통합을 참고하세요.

커스텀 데이터 유출 가드레일

데이터나 문서 유형, 콘텐츠 유형, 특정 패턴·키워드 매칭으로 민감 데이터를 감지하는 커스텀 데이터 유출 가드레일을 구성할 수 있어요. 특히 시스템 프롬프트 감지를 설정하면, 공격자가 추가 공격에 악용할 목적으로 LLM 출력에서 시스템 프롬프트를 추출하려는 시도를 막아요.

Check Point PII 감지기

AI Guardrails는 다음 엔티티를 식별해요:

  • 전체 이름(Full names)
  • 미국 우편 주소(United States mailing addresses)
  • 미국 전화번호(United States Phone numbers)
  • 이메일 주소(Email addresses)
  • IP 주소(Internet Protocol addresses)
  • 신용카드 번호(Credit card numbers)
  • IBAN(International Bank Account Numbers)
  • 미국 사회보장번호(US Social Security Numbers)

이메일 주소 감지기와 미국 사회보장번호 감지기는 신뢰도 임계값 수준을 미세 조정할 수 없어요. IP 주소 감지기는 예약 주소(예: 198.51.100.0/24)를 더 낮은 신뢰도로 표시해요. 이 주소들은 버전 번호나 다른 PII가 아닌 문자열로 자주 등장하기 때문이에요. 8.8.8.8(Google 공개 DNS) 같은 일반 DNS 주소나 루프백, 링크-로컬, 멀티캐스트, 기타 예약 IP 주소는 PII로 보고하지 않아요. 잘못된 IP(10.920a.218.238, 257.168.0.1)나 ::1, 127.0.0.1 같은 주소도 감지하지 않아요.

프라이버시 보장

Check Point의 AI 모델은 어떤 PII에도 훈련되지 않아요. 감지된 모든 PII는 Check Point 시스템에 기록되기 전에 마스킹돼요.

더 알아보기