가드레일 정책

가드레일 정책 (Guardrail Policies)

LiteLLM에서 가드레일에 정책을 설정하는 방법을 알려드려요. 유해 콘텐츠 감지, PII 보호, 젤브레이크 방어 등 특정 목표를 위한 정책을 구성해요.

출처: 문서

본문

개요 (Overview)

가드레일 정책은 특정 보안·안전 요구사항을 다루는 지침과 규칙 모음이에요. LiteLLM에서 정책은 가드레일 구성(공급자, mode, 임계값, 파라미터)으로 표현되며, 요청/응답이 검사되는 방식을 결정해요.

정책 구성 요소 (Policy building blocks)

  • 공급자 (Provider): 검사를 실행하는 백엔드(예: presidio, lakera_v2, openai_moderation, litellm_content_filter)
  • 모드 (Mode): pre_call, post_call, during_call 등 검사 시점
  • 임계값 (Threshold): 차단/플래그 여부를 결정하는 점수 임계값
  • 동작 (Action): BLOCK(차단), MASK(마스킹), LOG(기록) 등 위반 시 취할 조치
  • 대상 (Scope): 입력만, 출력만, 또는 둘 다 검사할지

설정 예시 (Configuration example)

guardrails:
  - guardrail_name: "content-policy"
    litellm_params:
      guardrail: litellm_content_filter
      mode: [pre_call, post_call]
      default_on: true
      categories:
        - category: "harmful_violence"
          enabled: true
          action: "BLOCK"
          severity_threshold: "medium"

참고 사항 (Notes)

정책별 권장 설정, 규제 준수 템플릿, 커스텀 정책 작성 방법 등 자세한 내용은 원문 문서를 참고하세요.