Cerebras 프로바이더
Cerebras 프로바이더
Cerebras API의 강력한 언어 모델을 AI SDK에서 쓸 수 있게 해주는 프로바이더예요. Wafer-Scale Engine과 CS-3 시스템으로 구동되는 고속 추론을 제공해요.
출처: 문서
본문
Cerebras 프로바이더는 Cerebras API를 통한 강력한 언어 모델 접근을 제공해요. Wafer-Scale Engine과 CS-3 시스템으로 구동되는 고속 추론 능력을 포함해요.
API 키는 Cerebras Platform에서 얻을 수 있어요.
설정 (Setup)
Cerebras 프로바이더는 @ai-sdk/cerebras 모듈로 제공돼요. 다음과 같이 설치할 수 있어요:
프로바이더 인스턴스 (Provider Instance)
@ai-sdk/cerebras에서 기본 프로바이더 인스턴스 cerebras를 불러올 수 있어요:
import { cerebras } from '@ai-sdk/cerebras';
커스텀 구성이 필요하다면 createCerebras를 불러와 원하는 설정으로 프로바이더 인스턴스를 만들 수 있어요:
import { createCerebras } from '@ai-sdk/cerebras';
const cerebras = createCerebras({
apiKey: process.env.CEREBRAS_API_KEY ?? '',
});
Cerebras 프로바이더 인스턴스를 커스터마이즈할 때 사용할 수 있는 선택적 설정은 다음과 같아요:
-
baseURL string
API 호출에 다른 URL 접두사를 사용해요. 기본 접두사는
https://api.cerebras.ai/v1이에요. -
apiKey string
Authorization헤더로 보내는 API 키예요. 기본값은CEREBRAS_API_KEY환경 변수예요. -
headers Record<string,string>
요청에 포함할 커스텀 헤더예요.
-
fetch (input: RequestInfo, init?: RequestInit) => Promise<Response>
커스텀 fetch 구현이에요.
언어 모델 (Language Models)
프로바이더 인스턴스로 언어 모델을 만들 수 있어요:
import { cerebras } from '@ai-sdk/cerebras';
import { generateText } from 'ai';
const { text } = await generateText({
model: cerebras('gpt-oss-120b'),
prompt: 'Write a vegetarian lasagna recipe for 4 people.',
});
Cerebras 언어 모델은 streamText 함수에서 사용할 수 있어요 (AI SDK Core 참고).
프로바이더 인스턴스로 Cerebras 언어 모델을 만들 수 있어요. 첫 번째 인자는 모델 ID예요. 예: gpt-oss-120b:
const model = cerebras('gpt-oss-120b');
.languageModel()과 .chat() 메서드도 사용할 수 있어요:
const model = cerebras.languageModel('gpt-oss-120b');
const model = cerebras.chat('gpt-oss-120b');
추론 모델 (Reasoning Models)
Cerebras는 최종 응답 전에 중간 thinking 토큰을 생성하는 gpt-oss-120b와 gemma-4-31b를 포함한 추론 모델을 제공해요. 추론 출력은 표준 AI SDK reasoning 파트를 통해 스트리밍돼요.
gpt-oss-120b의 경우 reasoningEffort 프로바이더 옵션으로 추론 깊이를 제어할 수 있어요:
import { cerebras } from '@ai-sdk/cerebras';
import { streamText } from 'ai';
const result = streamText({
model: cerebras('gpt-oss-120b'),
providerOptions: {
cerebras: {
reasoningEffort: 'medium',
},
},
prompt: 'How many "r"s are in the word "strawberry"?',
});
for await (const part of result.stream) {
if (part.type === 'reasoning') {
console.log('Reasoning:', part.text);
} else if (part.type === 'text-delta') {
process.stdout.write(part.textDelta);
}
}
챗봇에 reasoning을 통합하는 방법에 대한 자세한 내용은 AI SDK UI: Chatbot을 참고하세요.
프로바이더 옵션 (Provider Options)
Cerebras 언어 모델에 사용할 수 있는 선택적 프로바이더 옵션은 다음과 같아요:
-
parallelToolCalls boolean
툴 사용 중 병렬 함수 호출을 활성화할지 여부예요. 기본값은
true. -
logprobs boolean
생성된 토큰에 대한 로그 확률을 반환할지 여부예요. 기본값은
false. -
topLogprobs number
각 토큰 위치에서 반환할 가장 가능성 높은 토큰 수예요.
0부터20까지의 값을 받아요.logprobs가true여야 해요. -
logitBias Record<string, number>
토큰 ID를
-100부터100까지의 편향 값에 매핑해요. -
serviceTier 'auto' | 'default' | 'flex' | 'priority'
요청 우선순위를 제어해요. 가용성은 계정과 엔드포인트에 따라 달라요.
-
reasoningEffort 'none' | 'low' | 'medium' | 'high'
지원되는 모델이 수행하는 추론의 양을 제어해요. 지원 값과 기본값은 모델에 따라 달라요.
-
reasoningFormat 'none' | 'parsed' | 'text_parsed' | 'raw' | 'hidden'
응답에서 추론 콘텐츠가 어떻게 나타나는지 제어해요. 형식 지원은 모델에 따라 달라요.
-
prediction { type: 'content'; content: string | Array<{ type: 'text'; text: string }> }
응답의 대부분이 이미 알려진 요청을 가속할 수 있는 예측 출력을 제공해요.
-
promptCacheKey string
관련 요청을 같은 프롬프트 캐시로 라우팅해요. 값은 최대 1024자를 포함할 수 있으며 계정 수준 활성화가 필요해요.
-
user string
최종 사용자를 나타내는 고유 식별자로, 모니터링과 남용 감지에 도움이 될 수 있어요.
-
strictJsonSchema boolean
엄격한 JSON 스키마 검증을 사용할지 여부예요.
true이면 모델이 제약 디코딩을 사용해 스키마 준수를 보장해요. 기본값은true.
예를 들어:
import {
cerebras,
type CerebrasLanguageModelChatOptions,
} from '@ai-sdk/cerebras';
import { generateText } from 'ai';
const result = await generateText({
model: cerebras('gpt-oss-120b'),
prompt: 'Explain why the sky is blue.',
providerOptions: {
cerebras: {
reasoningEffort: 'low',
reasoningFormat: 'parsed',
promptCacheKey: 'conversation-123',
} satisfies CerebrasLanguageModelChatOptions,
},
});
모델 기능 (Model Capabilities)
| 모델 | 이미지 입력 | 객체 생성 | 툴 사용 | 툴 스트리밍 | 추론 |
|---|---|---|---|---|---|
gpt-oss-120b |
|||||
gemma-4-31b |
더 알아보기 (Learn more)
- AI Gateway
- xAI Grok
- OpenAI
- Azure OpenAI
- Anthropic
- Open Responses
- Claude Platform on AWS
- Amazon Bedrock
- Groq
- Fal
- AssemblyAI
- GMI Cloud
- TypeSafe
- DeepInfra
- Deepgram
- Black Forest Labs
- Gladia
- Hume
- Google Vertex AI
- Rev.ai
- Baseten
- Hugging Face
- QuiverAI
- Fish Audio
- Mistral AI
- Z.AI
- Together.ai
- Cohere
- Fireworks
- Voyage AI
- DeepSeek
- Moonshot AI
- Alibaba
- MiniMax
- Cerebras
- Replicate
- Prodia
- Perplexity
- Luma
- ByteDance
- Kling AI
- ElevenLabs
- Cartesia