사용법·API (로컬 추론과 NIM)
사용법·API (로컬 추론과 NIM)
Evo 2는 로컬에서 추론·생성을 위해 Vortex 추론 코드를 쓰는 GitHub 저장소(arcinstitute/evo2)를 통해 배포돼요. 훈련·파인튜닝은 Savanna나 NVIDIA BioNeMo 프레임워크로 해요.
설치
Transformer Engine과 Flash Attention을 먼저 설치한 뒤 Evo 2를 설치해요. conda로 Transformer Engine을 설치하는 걸 권장해요.
git clone https://github.com/arcinstitute/evo2
cd evo2
pip install -e .
로컬 추론
저장소의 파이썬 API를 통해 Evo 2를 로컬에서 내려받아 사용할 수 있어요. 노트북 예제가 저장소의 notebooks/에 정리돼 있어서, Evo2Predictor 같은 API로 서열 임베딩·생성·예측을 바로 시도해볼 수 있어요.
NVIDIA NIM / 호스팅 API
Evo 2는 NVIDIA NIM 컨테이너와 호스팅 API로도 제공돼요.
- NIM: NVIDIA NIM 카탈로그에서
evo2검색 - 호스팅 API: build.nvidia.com/arc/evo2-40b
- NIM 문서: docs.nvidia.com/nim/bionemo/evo2/latest/overview.html
- 퀵스타트: docs.nvidia.com/nim/bionemo/evo2/latest/quickstart-guide.html
파인튜닝
Evo 2를 파인튜닝하려면 Savanna를 쓰거나, NVIDIA BioNeMo 프레임워크의 Evo 2 파인튜닝 튜토리얼을 따르면 돼요.
데이터셋
사전훈련에 쓰인 OpenGenome2 데이터셋은 Hugging Face(arcinstitute/opengenome2)에서 받을 수 있고, raw fasta 또는 JSONL(각각 메타데이터 포함) 형태로 제공돼요.