Perplexity Router 모델 & 가격
Perplexity Router 모델 & 가격
Router API에서 쓸 수 있는 모델 카탈로그와 토큰별 요금을 정리한 페이지예요. Perplexity가 호스팅하는 모델과 타사 제공 모델이 모두 포함돼 있고, 모델마다 입력·출력·캐시 읽기 요금이 달라요. 실제 호출 전에 어떤 모델이 있고 얼마인지 확인하는 데 유용해요.
⚠️ Router API는 현재 private preview 상태예요. 사용 권한을 얻으려면 [email protected]로 요청해야 합니다.
개요
아래 모든 모델은 Router의 Chat Completions·Messages 두 엔드포인트에서 같은 creator/model-name id로 호출돼요. 가격은 100만 토큰당 USD이고, 요청이 어떻게 처리됐든 요청한 모델의 요금으로 청구돼요.
캐시 입력은 신선한 입력과 별도로 청구돼요. 캐시 읽기는 모델별로 할인된 요율("Cache read" 열)로, 캐시 쓰기는 별도 쓰기 요율이 없으면 입력 요율로 각각 청구돼요. 추론(reasoning) 토큰은 출력 요율로 청구됩니다. 참고로 perplexity/glm-5.3-flash는 캐시 읽기는 지원하지만 캐시 쓰기는 지원하지 않아요.
Perplexity 호스팅 모델
오픈소스 모델을 Perplexity가 직접 호스팅해요. perplexity/ 접두사는 누가 서빙하는지를 나타내지, 누가 만들었는지를 뜻하지는 않아요. DeepSeek·Moonshot AI·NVIDIA·Z.AI의 모델이 포함돼 있어요.
| 모델 | 입력($/1M) | 출력($/1M) | 캐시 읽기($/1M) |
|---|---|---|---|
perplexity/deepseek-v4-flash-0731 |
0.13 | 0.26 | 0.028 |
perplexity/kimi-k3 |
3.00 | 15.00 | 0.30 |
perplexity/glm-5.2 |
1.40 | 4.40 | 0.14 |
perplexity/glm-5.3 |
1.40 | 4.40 | 0.26 |
perplexity/glm-5.3-flash |
0.15 | 0.50 | 0.03 |
perplexity/nemotron-3.5-lightning-30b-a3b |
0.0115 | 0.17 | 0.00115 |
perplexity/nemotron-3-ultra-550b-a55b |
0.25 | 2.50 | 0.25 |
카탈로그는 언제든 프로그램으로 조회할 수 있어요. curl 'https://api.perplexity.ai/router/v1/models'를 호출하면 모든 가용 모델이 id 기준으로 정렬돼 나오고, 각 모델의 기본 토큰 가격도 함께 담겨요. 카탈로그에 없는 모델을 요청하면 잘못된 모델을 명시한 400을 돌려줘요——즉 카탈로그 자체가 허용 목록(allowlist) 역할을 해요.
더 알아보기
- Router API Quickstart — 첫 호출하기
- Pricing & Billing — 크레딧·청구·사용량 티어