Ollama API - 실행 중 모델 목록 조회
Ollama API - 실행 중 모델 목록 조회 (List running models)
/api/ps는 현재 메모리에 로드되어 실행 중인 모델 목록을 가져오는 엔드포인트예요. 어떤 모델이 지금 떠 있는지, VRAM을 얼마나 쓰는지 확인할 때 유용합니다.
엔드포인트
GET /api/ps
요청
curl http://localhost:11434/api/ps
응답 예시
{
"models": [
{
"name": "gemma4",
"model": "gemma4",
"size": 6591830464,
"digest": "c6eb396dbd5992bbe3f5cdb947e8bbc0ee413d7c17e2beaae69f5d569cf982eb",
"details": {
"parent_model": "",
"format": "gguf",
"family": "gemma4",
"families": ["gemma4"],
"parameter_size": "8.0B",
"quantization_level": "Q4_K_M"
},
"expires_at": "2025-10-17T16:47:07.93355-07:00",
"size_vram": 5333539264,
"context_length": 4096
}
]
}
주요 응답 필드
| 필드 | 설명 |
|---|---|
models |
현재 실행 중인 모델 목록 |
name / model |
실행 중인 모델 이름 |
size |
모델 크기 (바이트) |
digest |
모델의 SHA256 다이제스트 |
details |
모델 형식·패밀리 같은 상세 정보 |
expires_at |
모델이 언로드될 시각 |
size_vram |
VRAM 사용량 (바이트) |
context_length |
실행 중인 모델의 컨텍스트 길이 |