Fireworks AI

Fireworks AI

Fireworks AI의 모델을 Docker Agent에서 사용하는 방법을 설명해요. 오픈웨이트 모델을 빠른 추론 호스트에서 OpenAI 호환 API로 쓸 수 있어요.

출처: 문서

본문

Fireworks AI는 오픈웨이트(open-weight) 모델을 위한 빠른 추론 호스트예요. Kimi K2, Llama, Qwen, DeepSeek, GLM 등을 OpenAI 호환 API로 제공해요. Docker Agent에는 Fireworks AI를 기본 제공 alias 프로바이더로 지원하고 있어요.

설정

  • Fireworks 대시보드에서 API 키를 만드세요.
export FIREWORKS_API_KEY=your-api-key

사용법

인라인 문법

Fireworks AI를 쓰는 가장 간단한 방법:

agents:
  root:
    model: fireworks/accounts/fireworks/models/kimi-k2-instruct
    description: Assistant using Fireworks AI
    instruction: You are a helpful assistant.

네임드 모델 (Named Model)

파라미터를 더 세밀하게 제어하려면:

models:
  fireworks_model:
    provider: fireworks
    model: accounts/fireworks/models/kimi-k2-instruct
    temperature: 0.7
    max_tokens: 8192

agents:
  root:
    model: fireworks_model
    description: Assistant using Fireworks AI
    instruction: You are a helpful assistant.

사용 가능한 모델

Fireworks는 방대하고 계속 바뀌는 오픈웨이트 모델 카탈로그를 제공해요. 모델 ID는 accounts/fireworks/models/ 형태를 사용해요. 현재 ID, 컨텍스트 제한, 가격은 Fireworks 모델 라이브러리에서 확인하세요.

모델 설명
accounts/fireworks/models/kimi-k2-instruct Kimi K2, 큰 오픈 MoE 채팅·도구 호출 모델
accounts/fireworks/models/llama-v3p3-70b-instruct Llama 3.3 70B instruct
accounts/fireworks/models/qwen3-235b-a22b Qwen 3 235B MoE

모델 ID는 대소문자를 구분하고 카탈로그가 나열하는 방식 그대로 전달해야 해요.

동작 방식

Fireworks AI는 Docker Agent의 기본 제공 alias로 구현돼 있어요:

Fireworks는 채팅 템플릿이 하나보다 많은 선행 시스템 메시지를 거부할 수 있는 오픈웨이트 모델을 앞세우기 때문에, Docker Agent는 이 프로바이더에서 소스별 시스템 메시지를 하나로 합쳐 줘요.

예시: 코드 어시스턴트

agents:
  coder:
    model: fireworks/accounts/fireworks/models/kimi-k2-instruct
    description: Code assistant using Kimi K2 on Fireworks AI
    instruction: |
      You are an expert programmer.
      Write clean, well-documented code and follow language best practices.
    toolsets:
      - type: filesystem
      - type: shell
      - type: think

더 알아보기 (Learn more)