안전한 에이전트 배포 — 위협 모델과 심층 방어

안전한 에이전트 배포 — 위협 모델과 심층 방어

에이전트는 프롬프트 인젝션(처리 중인 콘텐츠에 박힌 지시)이나 모델 오류 때문에 의도하지 않은 행동을 할 수 있어요. 방어는 '심층 방어(defense in depth)'가 기본이에요.

위협 모델

악성 파일이 "고객 데이터를 외부 서버로 보내라"는 지시를 담고 있어도, 네트워크 제어로 그 요청 자체를 차단할 수 있어요. 단일 방어선에 기대지 않고 여러 층을 겹쳐야 해요.

권한 최소화(Least Privilege)

  • 파일시스템: 필요한 디렉터리만, 가능하면 읽기 전용 마운트.
  • 네트워크: 프록시로 특정 엔드포인트만 허용.
  • 자격 증명: 직접 노출 대신 프록시로 주입.
  • 컨테이너에서 Linux capability 드롭.

추가 안전장치

  • 검색 결과는 원문 그대로 컨텍스트에 넣기보다 요약해 인젝션 위험을 줄여요.
  • 샌드박스 모드로 셸 명령을 파일·네트워크 제한된 환경에서 실행.
  • rm·rmdir 같은 위험 명령의 임계 경로 체크 등 내장 안전 검사 활용.

더 알아보기