Ollama API - 실행 중 모델 목록 조회

Ollama API - 실행 중 모델 목록 조회 (List running models)

/api/ps는 현재 메모리에 로드되어 실행 중인 모델 목록을 가져오는 엔드포인트예요. 어떤 모델이 지금 떠 있는지, VRAM을 얼마나 쓰는지 확인할 때 유용합니다.

출처: 공식문서 - List running models

엔드포인트

GET /api/ps

요청

curl http://localhost:11434/api/ps

응답 예시

{
  "models": [
    {
      "name": "gemma4",
      "model": "gemma4",
      "size": 6591830464,
      "digest": "c6eb396dbd5992bbe3f5cdb947e8bbc0ee413d7c17e2beaae69f5d569cf982eb",
      "details": {
        "parent_model": "",
        "format": "gguf",
        "family": "gemma4",
        "families": ["gemma4"],
        "parameter_size": "8.0B",
        "quantization_level": "Q4_K_M"
      },
      "expires_at": "2025-10-17T16:47:07.93355-07:00",
      "size_vram": 5333539264,
      "context_length": 4096
    }
  ]
}

주요 응답 필드

필드 설명
models 현재 실행 중인 모델 목록
name / model 실행 중인 모델 이름
size 모델 크기 (바이트)
digest 모델의 SHA256 다이제스트
details 모델 형식·패밀리 같은 상세 정보
expires_at 모델이 언로드될 시각
size_vram VRAM 사용량 (바이트)
context_length 실행 중인 모델의 컨텍스트 길이

더 알아보기