Kong AI Prompt Guard — 프롬프트 가드레일

Kong AI Prompt Guard — 프롬프트 가드레일

AI Prompt Guard는 PCRE 호환 정규식의 allow/deny 목록을 설정해 텍스트 완성 요청의 오남용을 막아주는 플러그인이에요. 특정 프롬프트·단어·구절을 허용하거나 차단해 LLM 서비스 사용을 더 잘 통제하게 해 줍니다.

어떻게 동작하나

  • roleuser인 채팅 메시지를 스캔해 설정된 표현식을 검사해요.
  • llm/v1/chat에선 옵션으로 기존 대화 이력을 무시하고 마지막 user 메시지만 검사할 수 있어요.
  • llm/v1/completions에선 prompt 전체를 매 요청마다 검사해요.

allow·deny 규칙

  • deny에 매칭되면 호출자에게 400 Bad Request.
  • allow만 있고 매칭이 없으면 역시 400.
  • deny·allow 둘 다 있으면 deny가 우선돼요. deny에 안 걸리고 allow에 걸릴 때만 LLM으로 통과돼요.
  • 복잡한 프롬프트 인젝션 시도(숨은 유니코드 문자 등)를 탐지하는 베스트 프랙티스 정규식 예시가 제공돼요.

전제조건

  • AI Proxy(또는 AI Proxy Advanced)가 먼저 구성돼 있어야 해요. 그 위에 가드레일로 얹는 구조예요.

언제 쓰나

  • 규정 준수(compliance)와 무결성을 지키며 LLM을 운영하고 싶을 때, 특히 프롬프트 인젝션·금지어를 차단해야 할 때요.

더 알아보기