Command A 모델
Command A 모델
Command A는 Cohere의 가장 크고 성능이 뛰어난 생성 모델이에요. 기업용 에이전트를 만들 때 특히 잘 맞으면서도, 추론(inference) 비용은 낮게 유지한 게 특징이에요. 111B 파라미터의 거대한 모델이지만 GPU 2장(A100s/H100s)만으로 구동할 수 있고, 컨텍스트 길이는 256K예요. 전작인 Command R+ 08-2024보다 추론 처리량이 150% 높다고 알려져 있어요.
출처: Command A
호출 방식과 사양
Command A를 Chat API로 호출할 때 쓰는 모델 ID는 command-a-plus-05-2026이에요. Chat V2, Chat V1, Chat Completions 방식에서 각각 쓸 수 있어요.
- 컨텍스트 윈도우: 256,000 토큰
- 최대 출력 토큰: 8,000 토큰
- 지식 컷오프(Knowledge Cutoff): 2024년 6월 1일
- 하드웨어: A100s/H100s GPU 2장
무엇에 쓸 수 있을까
- Tool use — 검색 엔진, API, 벡터 데이터베이스 같은 도구를 모델에 연결해서 기본 기능을 확장할 수 있어요.
- 에이전트(Agents) — 다단계 tool use 능력 덕분에 빠르고 유능한 REACT 에이전트를 만들 수 있어요. 복잡한 질문을 하위 목표로 쪼개는 작업, 복잡한 추론과 능동적 정보 탐색이 필요한 영역에서 좋은 성능을 보여요.
- RAG — 외부 데이터 소스에 출력을 grounding 해 정확도를 높이는 retrieval augmented generation에 잘 맞아요.
- 다국어 — 영어, 프랑스어, 스페인어, 일본어, 한국어, 중국어, 아랍어 등 23개 언어에서 잘 동작하도록 학습됐어요. 사용자 언어로 응답하거나, 다른 언어로 출력하라는 지시를 따르는 데 능숙해요. 교차 언어(번역 등) 작업에도 강해요.
Command A는 수다스러워요(Chatty)
기본적으로 Command A는 대화에 최적화되어 있어서 답변이 장황하고 코드를 강조하기 위해 markdown을 사용해요. 이 동작을 바꾸고 싶다면 시스템 지시(system instruction)로 "답만 짧게 주고 markdown이나 코드 블록 표시를 쓰지 말라"고 요청하면 돼요.