Ollama Cloud

Ollama Cloud

Ollama의 클라우드 모델은 강력한 GPU 없이도 실행할 수 있는 새 종류의 모델이에요. 클라우드 모델은 Ollama의 클라우드 서비스로 자동 오프로드되면서 로컬 모델과 같은 기능을 제공하므로, 개인 컴퓨터에 들어가지 못하는 더 큰 모델을 실행하면서 기존 로컬 도구를 계속 쓸 수 있게 해줘요.

지원되는 모델

지원되는 모델 목록은 Ollama의 모델 라이브러리를 참고하세요.

클라우드 모델 실행

Ollama의 클라우드 모델은 ollama.com의 계정이 필요해요. 로그인하거나 계정을 만들려면 다음을 실행하세요.

ollama signin

클라우드 모델을 실행하려면 터미널을 열고 다음을 실행합니다.

ollama run gpt-oss:120b-cloud

먼저 클라우드 모델을 풀해 접근할 수 있게 만듭니다.

ollama pull gpt-oss:120b-cloud

다음으로 Ollama의 JavaScript 라이브러리를 설치합니다.

npm i ollama

그런 다음 라이브러리로 클라우드 모델을 실행합니다.

import { Ollama } from "ollama";

const ollama = new Ollama();

const response = await ollama.chat({
  model: "gpt-oss:120b-cloud",
  messages: [{ role: "user", content: "Explain quantum computing" }],
  stream: true,
});

for await (const part of response) {
  process.stdout.write(part.message.content);
}

Cloud API 접근

클라우드 모델은 ollama.com의 API에서 직접 접근할 수도 있어요. 이 모드에서는 ollama.com이 원격 Ollama 호스트 역할을 합니다.

인증

ollama.com의 API에 직접 접근하려면 먼저 API 키를 만드세요. 그런 다음 OLLAMA_API_KEY 환경 변수를 API 키로 설정합니다.

export OLLAMA_API_KEY=your_api_key

모델 목록

Ollama API를 통해 직접 사용할 수 있는 모델은 다음으로 목록을 볼 수 있어요.

curl https://ollama.com/api/tags

먼저 Ollama의 Python 라이브러리를 설치합니다.

pip install ollama

그런 다음 요청을 보냅니다.

import os
from ollama import Client

client = Client(
    host="https://ollama.com",
    headers={'Authorization': 'Bearer ' + os.environ.get('OLLAMA_API_KEY')}
)

messages = [
  {
    'role': 'user',
    'content': 'Why is the sky blue?',
  },
]

for part in client.chat('gpt-oss:120b', messages=messages, stream=True):
  print(part['message']['content'], end='', flush=True)

먼저 Ollama의 JavaScript 라이브러리를 설치합니다.

npm i ollama

다음으로 모델에 요청을 보냅니다.

import { Ollama } from "ollama";

const ollama = new Ollama({
  host: "https://ollama.com",
  headers: {
    Authorization: "Bearer " + process.env.OLLAMA_API_KEY,
  },
});

const response = await ollama.chat({
  model: "gpt-oss:120b",
  messages: [{ role: "user", content: "Explain quantum computing" }],
  stream: true,
});

for await (const part of response) {
  process.stdout.write(part.message.content);
}

로컬 전용

Ollama는 Ollama의 클라우드 기능을 비활성화해 로컬 전용 모드로 실행할 수 있어요.

폐기(Retirement)

Ollama는 더 좋은 새 오픈소스 모델이 출시됨에 따라 가끔 이전 버전의 클라우드 모델을 더 이상 지원하지 않고 폐기해요. Ollama Cloud 모델에 의존하는 도구와 애플리케이션은 계속 동작하려면 업데이트가 필요할 수 있어요. 영향받는 사용자에게는 모델 지원 중단과 폐기 전에 미리 통지합니다. 지원 중단은 이메일과 Ollama 웹사이트를 통해 공지돼요. Ollama Cloud 모델 폐기는 로컬 모델에는 영향을 주지 않습니다.

예정된 폐기

Retirement date Model Recommended alternative
July 31, 2026 minimax-m2.5 minimax-m2.7
July 31, 2026 kimi-k2.5 kimi-k2.6

지난 폐기

Model Recommended alternative
deepseek-v3.1:671b deepseek-v4-flash
deepseek-v3.2 deepseek-v4-flash
devstral-2:123b mistral-large-3:675b
devstral-small-2:24b
ministral-3:14b
ministral-3:3b
ministral-3:8b
gemini-3-flash-preview minimax-m3
gemma3:12b gemma4:31b
gemma3:27b gemma4:31b
gemma3:4b gemma4:31b
glm-4.7 glm-5.2
glm-5 glm-5.2
minimax-m2.1 minimax-m3
qwen3-coder-next qwen3.5:397b
qwen3-coder:480b qwen3.5:397b
Model Recommended alternative
rnj-1:8b
Model Recommended alternative
kimi-k2-thinking kimi-k2.6
kimi-k2:1t kimi-k2.6
minimax-m2 minimax-m3
glm-4.6 glm-5.1
qwen3-next:80b qwen3.5
qwen3-vl:235b qwen3.5
qwen3-vl:235b-instruct qwen3.5
cogito-2.1:671b deepseek-v4-flash