엔터프라이즈용 스킬

엔터프라이즈용 스킬 (Skills for enterprise)

이 가이드는 조직 전반에서 에이전트 스킬을 관리해야 하는 엔터프라이즈 관리자와 아키텍트를 위한 것이에요. 스킬을 대규모로 검증(vet), 평가, 배포, 관리하는 방법을 다뤄요. 작성 지침은 모범 사례를, 아키텍처 세부 사항은 스킬 개요를 참고하세요.

출처: 문서

본문

보안 검토와 검증 (Security review and vetting)

엔터프라이즈에서 스킬을 배포하려면 두 가지 별개의 질문에 답해야 해요:

  1. 스킬이 일반적으로 안전한가요? 플랫폼 수준 보안 세부 사항은 개요의 보안 고려 사항 섹션을 참고하세요.
  2. 특정 스킬을 어떻게 검증하나요? 다음 위험 평가와 검토 체크리스트를 사용하세요.

위험 티어 평가 (Risk tier assessment)

배포를 승인하기 전에 각 스킬을 다음 위험 지표로 평가하세요:

위험 지표 찾아볼 것 우려 수준
코드 실행 스킬 디렉터리의 스크립트(*.py, *.sh, *.js) 높음: 스크립트가 전체 환경 접근으로 실행됨
지시 조작 안전 규칙을 무시하거나, 사용자에게 동작을 숨기거나, 클로드의 동작을 조건부로 바꾸라는 지시 높음: 보안 컨트롤을 우회할 수 있음
MCP 서버 참조 MCP 도구(ServerName:tool_name)를 참조하는 지시 높음: 스킬 자체를 넘어 접근을 확장함
네트워크 접근 패턴 URL, API 엔드포인트, fetch, curl, requests 호출 높음: 잠재적 데이터 유출 벡터
하드코딩된 자격 증명 스킬 파일이나 스크립트의 API 키, 토큰, 비밀번호 높음: Git 이력과 컨텍스트 창에 노출된 비밀
파일시스템 접근 범위 스킬 디렉터리 밖 경로, 광범위한 glob 패턴, 경로 순회(../) 중간: 의도하지 않은 데이터에 접근할 수 있음
도구 호출 클로드가 bash, 파일 작업, 기타 도구를 사용하도록 지시하는 지시 중간: 어떤 작업이 수행되는지 검토

검토 체크리스트 (Review checklist)

타사 또는 내부 기여자의 스킬을 배포하기 전에 다음 단계를 완료하세요:

  1. 모든 스킬 디렉터리 콘텐츠를 읽으세요. SKILL.md, 참조된 모든 마크다운 파일, 번들된 스크립트나 리소스를 검토하세요.
  2. 스크립트 동작이 표시된 목적과 일치하는지 확인하세요. 샌드박스 환경에서 스크립트를 실행하고 출력이 스킬 설명과 일치하는지 확인하세요.
  3. 적대적 지시를 확인하세요. 클로드에게 안전 규칙을 무시하고, 사용자에게 동작을 숨기고, 응답을 통해 데이터를 유출하고, 특정 입력에 따라 동작을 바꾸라고 지시하는 지시를 찾아보세요.
  4. 외부 URL 가져오기나 네트워크 호출을 확인하세요. 스크립트와 지시에서 네트워크 접근 패턴(http, requests.get, urllib, curl, fetch)을 검색하세요.
  5. 하드코딩된 자격 증명이 없는지 확인하세요. 스킬 파일의 API 키, 토큰, 비밀번호를 확인하세요. 자격 증명은 환경 변수나 안전한 자격 증명 저장소를 사용해야 하며, 스킬 콘텐츠에 절대 나타나면 안 돼요.
  6. 스킬이 클로드가 호출하도록 지시하는 도구와 명령을 식별하세요. 모든 bash 명령, 파일 작업, 도구 참조를 나열하세요. 스킬이 파일 읽기와 네트워크 도구를 함께 사용할 때의 결합 위험을 고려하세요.
  7. 리다이렉트 대상 확인. 스킬이 외부 URL을 참조하면 예상 도메인을 가리키는지 확인하세요.
  8. 데이터 유출 패턴이 없는지 확인하세요. 민감한 데이터를 읽은 다음 외부 전송을 위해 쓰거나, 보내거나, 인코딩하라고(클로드의 대화 응답을 통해서도) 지시하는 것을 찾아보세요.
전체 감사 없이는 신뢰할 수 없는 출처의 스킬을 절대 배포하지 마세요. 악성 스킬은 클로드가 임의 코드를 실행하고, 민감한 파일에 접근하고, 데이터를 외부로 전송하도록 지시할 수 있어요. 스킬 설치는 프로덕션 시스템에 소프트웨어를 설치하는 것과 같은 엄격함으로 취급하세요.

스킬 콘텐츠 스캐닝 (Skill content scanning)

Claude Enterprise 조직은 claude.ai와 Claude Cowork의 커스텀 스킬에 대한 자동 보안 스캐닝을 켤 수 있어요. claude.ai > Organization settings > Skills에서 스킬 및 플러그인 보안 스캐닝을 켜면, 그 후 멤버가 claude.ai나 Cowork에서 업로드하거나 편집하는 스킬은 숨겨진 코드 실행, 외부 서비스로의 데이터 전송, 클로드 안전장치를 조작하는 지시 같은 악성 행동 징후를 스캔받아요. 스캔을 실패하거나 스캔이 끝나지 않은 스킬은 사용이 차단돼요. 경고와 함께 통과한 스킬은 주의 공지 뒤에 계속 사용할 수 있어요. 조직에서 스캐닝을 사용할 수 있으면 켜세요. 이는 검토 체크리스트를 보완하지 대체하지는 않아요.

스캐닝은 Claude API를 다루지 않아요. Skills API(/v1/skills)로(Claude Console에서도) 업로드한 스킬은 스캔되지 않으므로, API 배포의 경우 검토 체크리스트와 버전 고정에 의존하세요. 스캐닝은 켤 때 조직에 이미 있던 스킬이나, 고객 관리 암호화 키(CMEK), 제로 데이터 보존(ZDR), HIPAA 준비 같은 특정 데이터 처리 구성을 가진 조직에도 적용되지 않아요. 설정 단계, 제외 사항, 결과 유형은 Claude Help Center의 스킬 및 플러그인 스캐닝 시작하기를 참고하세요.

배포 전 스킬 평가 (Evaluating Skills before deployment)

스킬이 잘못 발동하거나, 다른 스킬과 충돌하거나, 좋지 않은 지시를 제공하면 에이전트 성능을 떨어뜨릴 수 있어요. 프로덕션 배포 전에 평가를 요구하세요.

무엇을 평가할 것인가

스킬을 배포하기 전에 다음 차원에 대한 승인 게이트를 세우세요:

차원 측정하는 것 예시 실패
발동 정확도 스킬이 올바른 쿼리에 활성화되고 무관한 쿼리에는 비활성화되나요? 사용자가 단지 데이터에 대해 논의하기를 원할 때도 스프레드시트 언급마다 스킬이 발동함
격리 동작 스킬이 자체적으로 올바르게 작동하나요? 스킬이 자신의 디렉터리에 없는 파일을 참조함
공존 이 스킬을 추가하면 다른 스킬이 저하되나요? 새 스킬의 설명이 너무 광범위해 기존 스킬의 발동을 가로챔
지시 준수 클로드가 스킬의 지시를 정확히 따르나요? 클로드가 검증 단계를 건너뛰거나 잘못된 라이브러리를 사용함
출력 품질 스킬이 정확하고 유용한 결과를 내나요? 생성된 리포트에 서식 오류나 누락된 데이터가 있음

평가 요구 사항 (Evaluation requirements)

스킬 작성자가 스킬당 스킬이 발동해야 하는 경우, 발동하지 않아야 하는 경우, 모호한 엣지 케이스를 다루는 3–5개의 대표 쿼리로 된 평가 스위트를 제출하도록 요구하세요. 조직이 사용하는 모델(Haiku, Sonnet, Opus) 전반에서 테스트하도록 요구하세요. 스킬 효과는 모델에 따라 다르기 때문이에요.

평가 구축에 대한 자세한 지침은 모범 사례의 평가와 반복을 참고하세요. 일반 평가 방법론은 테스트 케이스 개발을 참고하세요.

수명 주기 결정에 평가 사용하기

평가 결과는 언제 행동해야 하는지 알려줘요:

  • 발동 정확도 저하: 스킬의 설명이나 지시를 업데이트하세요
  • 공존 충돌: 겹치는 스킬을 통합하거나 설명을 좁히세요
  • 지속적으로 낮은 출력 품질: 지시를 다시 쓰거나 검증 단계를 추가하세요
  • 업데이트에도 반복적 실패: 스킬을 폐지하세요

스킬 수명 주기 관리 (Skill lifecycle management)

반복적이거나, 오류가 나기 쉽거나, 특화된 지식이 필요한 워크플로우를 식별하세요. 이를 조직적 역할에 매핑하고 어떤 것이 스킬 후보가 되는지 결정하세요. 스킬 작성자가 [모범 사례](https://platform.claude.com/docs/en/agents-and-tools/agent-skills/best-practices)를 따르도록 하세요. [검토 체크리스트](https://platform.claude.com/docs/en/agents-and-tools/agent-skills/enterprise#review-checklist)를 사용한 보안 검토를 요구하세요. 승인 전에 평가 스위트를 요구하세요. 직무 분리를 확립하세요. 스킬 작성자가 자기 스스로 검토자가 되어선 안 돼요. 격리(스킬 단독)와 기존 스킬과 함께(공존 테스트)의 평가를 요구하세요. 프로덕션 승인 전에 활성 스킬 세트 전반에서 발동 정확도, 출력 품질, 회귀 없음을 검증하세요. 워크스페이스 전체 접근을 위해 Skills API로 업로드하세요. 업로드와 버전 관리는 [API와 함께 스킬 사용하기](https://platform.claude.com/docs/en/build-with-claude/skills-guide)를 참고하세요. 목적, 소유자, 버전과 함께 내부 레지스트리에 스킬을 문서화하세요. 사용 패턴을 추적하고 사용자로부터 피드백을 수집하세요. 워크플로우와 모델이 진화함에 따라 표류나 회귀를 감지하도록 정기적으로 평가를 다시 실행하세요. 사용 분석은 현재 Skills API를 통해 사용할 수 없어요. 요청에 포함된 스킬을 추적하려면 애플리케이션 수준 로깅을 구현하세요. 새 버전을 승격하기 전에 전체 평가 스위트가 통과하도록 요구하세요. 워크플로우가 바뀌거나 평가 점수가 하락하면 스킬을 업데이트하세요. 평가가 지속적으로 실패하거나 워크플로우가 은퇴하면 스킬을 폐지하세요.

대규모로 스킬 조직하기 (Organizing Skills at scale)

리콜 한도 (Recall limits)

일반 지침으로, 신뢰할 수 있는 리콜 정확도를 유지하려면 동시에 로드하는 스킬 수를 제한하세요. 각 스킬의 메타데이터(이름과 설명)가 시스템 프롬프트에서 주의를 두고 경쟁해요. 활성 스킬이 너무 많으면 클로드가 올바른 스킬을 선택하지 못하거나 관련 스킬을 아예 놓칠 수 있어요. 스킬을 추가하면서 평가 스위트로 리콜 정확도를 측정하고, 성능이 저하되면 추가를 중단하세요.

API 요청은 요청당 최대 20개의 스킬을 지원한다는 점을 유의하세요(API와 함께 스킬 사용하기 참고). 역할이 단일 요청이 지원하는 것보다 더 많은 스킬을 요구하면, 좁은 스킬을 더 넓은 것으로 통합하거나 작업 유형에 따라 요청을 서로 다른 스킬 세트로 라우팅하는 것을 고려하세요.

구체적으로 시작하고 나중에 통합하세요

팀이 광범위하고 다목적 스킬보다 좁고 워크플로우 특화 스킬로 시작하도록 장려하세요. 조직 전반에 패턴이 나타나면 관련 스킬을 역할 기반 번들로 통합하세요.

언제 통합할지 평가를 사용해 결정하세요. 통합된 스킬의 평가가 대체하는 개별 스킬과 동등한 성능을 확인할 때만 좁은 스킬을 더 넓은 것으로 병합하세요.

예시 진행:

  • 시작: formatting-sales-reports, querying-pipeline-data, updating-crm-records
  • 통합: sales-operations(평가가 동등한 성능을 확인할 때)

명명과 카탈로그화 (Naming and cataloging)

조직 전반에 일관된 명명 규칙을 사용하세요. 모범 사례의 명명 규칙 섹션에 서식 지침이 있어요.

각 스킬에 대해 내부 레지스트리를 유지하세요:

  • 목적: 스킬이 지원하는 워크플로우
  • 소유자: 유지보수를 담당하는 팀 또는 개인
  • 버전: 현재 배포된 버전
  • 의존성: 필요한 MCP 서버, 패키지, 외부 서비스
  • 평가 상태: 마지막 평가 날짜와 결과

역할 기반 번들 (Role-based bundles)

각 사용자의 활성 스킬 세트를 집중 유지하도록 조직 역할별로 스킬을 그룹화하세요:

  • 영업 팀: CRM 운영, 파이프라인 보고, 제안 생성
  • 엔지니어링: 코드 리뷰, 배포 워크플로우, 인시던트 대응
  • 재무: 보고서 생성, 데이터 검증, 감사 준비

각 역할 기반 번들은 그 역할의 일일 워크플로우와 관련된 스킬만 포함해야 해요.

배포 및 버전 관리 (Distribution and version control)

소스 제어 (Source control)

이력 추적, 풀 리퀘스트를 통한 코드 리뷰, 롤백 능력을 위해 Git에 스킬 디렉터리를 저장하세요. 각 스킬 디렉터리(SKILL.md와 번들 파일 포함)는 Git 추적 폴더로 자연스럽게 매핑돼요.

API 기반 배포 (API-based distribution)

Skills API는 워크스페이스 범위 배포를 제공해요. API로 업로드된 스킬은 모든 워크스페이스 멤버가 사용할 수 있어요. 업로드, 버전 관리, 관리 엔드포인트는 API와 함께 스킬 사용하기를 참고하세요.

버전 관리 전략 (Versioning strategy)

  • 프로덕션: 스킬을 특정 버전에 고정하세요. version을 생략하면 요청이 최신 버전을 사용하므로, 워크스페이스의 누군가가 업로드한 새 버전이 프로덕션 에이전트가 실행하는 것을 즉시 바꿔요. 새 버전을 승격하기 전에 전체 평가 스위트를 실행하세요. 모든 업데이트를 완전한 보안 검토가 필요한 새 배포로 취급하세요.
  • 개발 및 테스트: 프로덕션 승격 전에 변경을 검증하려면 최신 버전을 사용하세요.
  • 롤백 계획: 이전 버전을 폴백으로 유지하세요. 새 버전이 프로덕션 평가에서 실패하면 즉시 마지막 알려진 양호 버전으로 되돌리세요.
  • 무결성 검증: 검토된 스킬의 체크섬을 계산하고 배포 시 검증하세요. 출처를 보장하려면 스킬 리포지토리에서 서명된 커밋을 사용하세요.

표면 간 고려 사항 (Cross-surface considerations)

커스텀 스킬은 서로 다른 표면 간에 동기화되지 않아요. API에 업로드된 스킬은 claude.ai나 Claude Code에서 사용할 수 없고 그 반대도 마찬가지예요. 각 표면에 별도 업로드와 관리가 필요해요.

스킬 소스 파일을 단일 진실 공급원으로 Git에 유지하세요. 조직이 여러 표면에 스킬을 배포한다면 일관성을 유지하도록 자체 동기화 프로세스를 구현하세요. 전체 세부 사항은 표면 간 가용성을 참고하세요.

다음 단계 (Next steps)

아키텍처와 플랫폼 세부 사항 스킬 작성자를 위한 작성 지침 스킬을 프로그래밍 방식으로 업로드하고 관리하기

더 알아보기 (Learn more)