모델 공급자

모델 공급자 (Model Providers)

당신이 만드는 모든 AI 앱은 모델 위에서 실행됩니다. Dify Cloud는 인기 모델을 기본 제공하고, 더 필요할 때 자체 공급자 계정과 키를 연결할 수 있게 해 줍니다. 모델은 워크스페이스 전체에서 공유되므로 팀 전체가 같은 모델로 작업합니다.

출처: 공식문서 - Model Providers

워크스페이스 소유자와 관리자만 공급자를 관리할 수 있습니다. 추가하는 모든 키는 워크스페이스 전체에서 작동하며, 해당 공급자와의 관계에서 당신의 계정으로 청구됩니다.

AI 크레딧으로 모델 사용하기

Dify Cloud는 인기 공급자 세트의 모델을 쓸 수 있는 AI 크레딧을 제공하므로, 시작하기 위해 자체 API 키가 필요하지 않습니다.

Integrations > Model Provider(또는 Marketplace)에서 이 공급자 중 하나를 설치하면 그 모델을 바로 쓸 수 있고, 각 AI 응답이 AI 크레딧을 소모합니다.

AI 응답은 단일 모델 호출(입력 하나 + 출력 하나)이며, 토큰을 얼마나 쓰든 한 응답으로 계산됩니다. 응답이 소모하는 크레딧 수는 모델에 따라 달라지는데, 큰 모델이 작은 모델보다 더 비쌉니다.

AI 크레딧이 지원하는 공급자와 모델별 크레딧 비용은 Dify 가격 페이지를 참고하세요.

지원 공급자로 자체 계정 사용하기

더 높은 속도 제한 또는 자체 공급자 계정으로의 청구를 원할 때, 지원되는 공급자에 자체 API 키를 추가하세요.

  1. Integrations > Model Provider에서 아직 설치하지 않았다면 공급자를 설치합니다.
  2. 카드의 Setup을 클릭하고 API 키와 필요한 다른 세부 정보를 입력합니다. Dify는 공급자를 사용 가능하게 만들기 전에 키를 확인합니다.

당신의 키와 AI 크레딧은 공존할 수 있습니다. 공급자 카드의 Usage Priority를 설정해 Dify가 어느 것을 먼저 쓰고 다른 것으로 폴백할지 제어할 수 있으므로, 크레딧이 소진되면 추가한 키가 대신 동작하게 할 수 있어요.

AI 크레딧이 지원하지 않는 공급자 연결

AI 크레딧이 지원하지 않는 공급자를 쓰려면 먼저 설치하고 자체 계정으로 실행합니다. AI 크레딧은 이 공급자들에는 적용되지 않습니다.

  1. Integrations > Model Provider에서 Install model providers를 찾아보거나 Marketplace에서 전체 목록을 확인.
  2. 공급자를 설치하고 Setup을 클릭해 API 키와 필요한 다른 세부 정보를 입력.

커스텀 모델 추가

공급자를 연결하면 그 모델은 바로 사용 준비가 되므로, 필요한 모델이 목록에 없을 때만 손으로 추가합니다 — 아주 새로운 모델이나 파인튜닝된 모델 같은 경우입니다.

공급자 카드의 Add Model을 클릭하고 모델 이름과 자격 증명을 주세요. 고정된 모델 세트만 서빙하는 공급자는 이 옵션을 제공하지 않습니다.

추가한 모델이 기존 모델과 이름과 유형이 일치하면, Dify는 중복을 만들지 않고 새 키를 그 모델에 연결합니다.

키 관리 (Manage Your Keys)

개발과 프로덕션을 분리하거나 여러 계정으로 사용량을 분산하고 싶을 때 공급자에 키를 여러 개 추가하세요.

  • 공급자 자체 모델의 경우 카드의 Configure를 클릭해 그들이 공유하는 키를 관리.
  • 직접 추가한 커스텀 모델의 경우 그 모델의 Configure를 클릭해 자체 키를 관리.

커스텀 모델은 자체 키에 의존합니다. 유일한 키를 삭제하면 모델도 함께 제거됩니다.

공급자 카드의 Manage Credentials를 클릭하면 모든 커스텀 모델의 키를 한곳에서 볼 수 있어요. 키는 커스텀 모델을 제거해도 여기에 남아 있어, 나중에 키를 다시 입력하지 않고 모델을 다시 추가할 수 있습니다.

앱이 기본으로 쓰는 모델 고르기

모델을 명시적으로 선택하지 않은 앱과 노드는 워크스페이스 기본값으로 폴백합니다. 오른쪽 위 Default Models를 클릭해 작업별 기본 모델을 설정하세요:

  • System Reasoning Model: 일반 LLM 작업의 기본.
  • Embedding Model: 지식 기반 콘텐츠를 인덱싱·검색.
  • Rerank Model: 검색 결과를 관련성 순으로 재정렬.
  • Speech-to-Text Model: 오디오를 텍스트로 변환.
  • Text-to-Speech Model: 텍스트를 오디오로 변환.

로드 밸런싱으로 키 간 요청 분산 Professional Team

한 키가 동시에 많은 요청을 처리하면 공급자의 속도 제한에 부딪혀 실패하기 시작할 수 있습니다.

로드 밸런싱을 사용해 같은 모델의 여러 키에 요청을 분산하면 단일 키가 병목이 되지 않습니다. Dify는 키를 차례로 순환하며, 한도에 닿은 키는 1분간 쉬게 한 뒤 다시 시도합니다.

  1. 목록에서 모델을 찾아 Configure > Load Balancing 선택.
  2. Add credential로 키를 풀에 추가.
  3. 최소 두 개의 키를 켠 뒤 Save. 로드 밸런싱을 쓰는 모델은 목록에 마커가 표시됩니다.

언제든 단일 키로 되돌릴 수 있으며, 로드 밸런싱 설정은 나중에 쓰기 위해 유지됩니다.

더 알아보기