Cheaper Inference Provider

Cheaper Inference Provider

Cheaper Inference는 OpenAI 호환 API를 통해 여러 AI 연구소의 모델에 접근할 수 있게 해 주는 API 게이트웨이예요. @ai-sdk/openai-compatible 모듈을 통해 AI SDK로 그 Chat Completions 엔드포인트를 사용할 수 있어요.

출처: 문서

본문

셋업 (Setup)

OpenAI Compatible provider를 설치하세요:

npm install @ai-sdk/openai-compatible
pnpm add @ai-sdk/openai-compatible
yarn add @ai-sdk/openai-compatible
bun add @ai-sdk/openai-compatible

Cheaper Inference API 키를 만들고 서버 사이드 환경 변수로 설정하세요:

export CHEAPER_INFERENCE_API_KEY=your-api-key

API 키 만드는 방법은 Cheaper Inference integration guide를 참고하세요.

Provider 인스턴스 (Provider Instance)

createOpenAICompatible로 Cheaper Inference provider 인스턴스를 만드세요:

import { createOpenAICompatible } from '@ai-sdk/openai-compatible';

const cheaperInference = createOpenAICompatible({
  name: 'cheaper-inference',
  apiKey: proces...KEY,
  baseURL: 'https://api.cheaperinference.com/v1',
});

apiKey 설정은 Authorization 헤더의 Bearer 토큰으로 키를 보내요.

언어 모델 (Language Models)

provider 인스턴스에 Cheaper Inference 모델 ID를 전달해 언어 모델을 만드세요:

const model = cheaperInference('gpt-5.4');

텍스트 생성 (Generate Text)

generateText를 사용해 모델로 텍스트를 생성하세요:

import { createOpenAICompatible } from '@ai-sdk/openai-compatible';
import { generateText } from 'ai';

const cheaperInference = createOpenAICompatible({
  name: 'cheaper-inference',
  apiKey: proces...KEY,
  baseURL: 'https://api.cheaperinference.com/v1',
});

const { text } = await generateText({
  model: cheaperInference('gpt-5.4'),
  prompt: 'Explain what an API gateway does in one sentence.',
});

console.log(text);

텍스트 스트리밍 (Stream Text)

streamText를 사용해 생성되는 대로 텍스트를 스트리밍하세요:

import { createOpenAICompatible } from '@ai-sdk/openai-compatible';
import { streamText } from 'ai';

const cheaperInference = createOpenAICompatible({
  name: 'cheaper-inference',
  apiKey: proces...KEY,
  baseURL: 'https://api.cheaperinference.com/v1',
});

const result = streamText({
  model: cheaperInference('gpt-5.4'),
  prompt: 'Count from 1 to 5, separated by spaces.',
});

for await (const textPart of result.textStream) {
  process.stdout.write(textPart);
}

지원 모델과 역량 (Supported Models and Capabilities)

이 통합은 Cheaper Inference의 OpenAI 호환 Chat Completions 엔드포인트를 텍스트 생성과 스트리밍에 사용해요. 도구, 비전, 기타 모델별 기능 지원은 선택한 모델에 따라 달라져요.

모델 카탈로그는 시간에 따라 변해요. 현재 모델 ID, 역량, 가격을 찾으려면 인증된 GET /models 엔드포인트를 사용하세요.

더 알아보기 (Learn more)