Cerebras 프로바이더

Cerebras 프로바이더

Cerebras API의 강력한 언어 모델을 AI SDK에서 쓸 수 있게 해주는 프로바이더예요. Wafer-Scale Engine과 CS-3 시스템으로 구동되는 고속 추론을 제공해요.

출처: 문서

본문

Cerebras 프로바이더는 Cerebras API를 통한 강력한 언어 모델 접근을 제공해요. Wafer-Scale Engine과 CS-3 시스템으로 구동되는 고속 추론 능력을 포함해요.

API 키는 Cerebras Platform에서 얻을 수 있어요.

설정 (Setup)

Cerebras 프로바이더는 @ai-sdk/cerebras 모듈로 제공돼요. 다음과 같이 설치할 수 있어요:

프로바이더 인스턴스 (Provider Instance)

@ai-sdk/cerebras에서 기본 프로바이더 인스턴스 cerebras를 불러올 수 있어요:

import { cerebras } from '@ai-sdk/cerebras';

커스텀 구성이 필요하다면 createCerebras를 불러와 원하는 설정으로 프로바이더 인스턴스를 만들 수 있어요:

import { createCerebras } from '@ai-sdk/cerebras';

const cerebras = createCerebras({
  apiKey: process.env.CEREBRAS_API_KEY ?? '',
});

Cerebras 프로바이더 인스턴스를 커스터마이즈할 때 사용할 수 있는 선택적 설정은 다음과 같아요:

  • baseURL string

    API 호출에 다른 URL 접두사를 사용해요. 기본 접두사는 https://api.cerebras.ai/v1이에요.

  • apiKey string

    Authorization 헤더로 보내는 API 키예요. 기본값은 CEREBRAS_API_KEY 환경 변수예요.

  • headers Record<string,string>

    요청에 포함할 커스텀 헤더예요.

  • fetch (input: RequestInfo, init?: RequestInit) => Promise<Response>

    커스텀 fetch 구현이에요.

언어 모델 (Language Models)

프로바이더 인스턴스로 언어 모델을 만들 수 있어요:

import { cerebras } from '@ai-sdk/cerebras';
import { generateText } from 'ai';

const { text } = await generateText({
  model: cerebras('gpt-oss-120b'),
  prompt: 'Write a vegetarian lasagna recipe for 4 people.',
});

Cerebras 언어 모델은 streamText 함수에서 사용할 수 있어요 (AI SDK Core 참고).

프로바이더 인스턴스로 Cerebras 언어 모델을 만들 수 있어요. 첫 번째 인자는 모델 ID예요. 예: gpt-oss-120b:

const model = cerebras('gpt-oss-120b');

.languageModel()과 .chat() 메서드도 사용할 수 있어요:

const model = cerebras.languageModel('gpt-oss-120b');
const model = cerebras.chat('gpt-oss-120b');

추론 모델 (Reasoning Models)

Cerebras는 최종 응답 전에 중간 thinking 토큰을 생성하는 gpt-oss-120b와 gemma-4-31b를 포함한 추론 모델을 제공해요. 추론 출력은 표준 AI SDK reasoning 파트를 통해 스트리밍돼요.

gpt-oss-120b의 경우 reasoningEffort 프로바이더 옵션으로 추론 깊이를 제어할 수 있어요:

import { cerebras } from '@ai-sdk/cerebras';
import { streamText } from 'ai';

const result = streamText({
  model: cerebras('gpt-oss-120b'),
  providerOptions: {
    cerebras: {
      reasoningEffort: 'medium',
    },
  },
  prompt: 'How many "r"s are in the word "strawberry"?',
});

for await (const part of result.stream) {
  if (part.type === 'reasoning') {
    console.log('Reasoning:', part.text);
  } else if (part.type === 'text-delta') {
    process.stdout.write(part.textDelta);
  }
}

챗봇에 reasoning을 통합하는 방법에 대한 자세한 내용은 AI SDK UI: Chatbot을 참고하세요.

프로바이더 옵션 (Provider Options)

Cerebras 언어 모델에 사용할 수 있는 선택적 프로바이더 옵션은 다음과 같아요:

  • parallelToolCalls boolean

    툴 사용 중 병렬 함수 호출을 활성화할지 여부예요. 기본값은 true.

  • logprobs boolean

    생성된 토큰에 대한 로그 확률을 반환할지 여부예요. 기본값은 false.

  • topLogprobs number

    각 토큰 위치에서 반환할 가장 가능성 높은 토큰 수예요. 0부터 20까지의 값을 받아요. logprobs가 true여야 해요.

  • logitBias Record<string, number>

    토큰 ID를 -100부터 100까지의 편향 값에 매핑해요.

  • serviceTier 'auto' | 'default' | 'flex' | 'priority'

    요청 우선순위를 제어해요. 가용성은 계정과 엔드포인트에 따라 달라요.

  • reasoningEffort 'none' | 'low' | 'medium' | 'high'

    지원되는 모델이 수행하는 추론의 양을 제어해요. 지원 값과 기본값은 모델에 따라 달라요.

  • reasoningFormat 'none' | 'parsed' | 'text_parsed' | 'raw' | 'hidden'

    응답에서 추론 콘텐츠가 어떻게 나타나는지 제어해요. 형식 지원은 모델에 따라 달라요.

  • prediction { type: 'content'; content: string | Array<{ type: 'text'; text: string }> }

    응답의 대부분이 이미 알려진 요청을 가속할 수 있는 예측 출력을 제공해요.

  • promptCacheKey string

    관련 요청을 같은 프롬프트 캐시로 라우팅해요. 값은 최대 1024자를 포함할 수 있으며 계정 수준 활성화가 필요해요.

  • user string

    최종 사용자를 나타내는 고유 식별자로, 모니터링과 남용 감지에 도움이 될 수 있어요.

  • strictJsonSchema boolean

    엄격한 JSON 스키마 검증을 사용할지 여부예요. true이면 모델이 제약 디코딩을 사용해 스키마 준수를 보장해요. 기본값은 true.

예를 들어:

import {
  cerebras,
  type CerebrasLanguageModelChatOptions,
} from '@ai-sdk/cerebras';
import { generateText } from 'ai';

const result = await generateText({
  model: cerebras('gpt-oss-120b'),
  prompt: 'Explain why the sky is blue.',
  providerOptions: {
    cerebras: {
      reasoningEffort: 'low',
      reasoningFormat: 'parsed',
      promptCacheKey: 'conversation-123',
    } satisfies CerebrasLanguageModelChatOptions,
  },
});

모델 기능 (Model Capabilities)

모델 이미지 입력 객체 생성 툴 사용 툴 스트리밍 추론
gpt-oss-120b
gemma-4-31b

더 알아보기 (Learn more)

전체 사이트맵