verl — 대규모 LLM 강화학습(RL) 훈련 프레임워크

verl

verl (Volcano Engine Reinforcement Learning) 은 대규모 언어모델 사후 훈련(post-training)을 위한 유연하고 효율적이며 프로덕션 준비된 RL 프레임워크예요. HybridFlow 논문의 오픈소스 구현으로, RL 알고리즘의 제어 흐름(control flow) 과 계산 엔진을 분리해 PPO·GRPO 같은 알고리즘을 FSDP·Megatron·vLLM·SGLang 등 다양한 백엔드 위에서 몇 줄로 표현해요.

이 카테고리의 문서

  • 개요: verl 문서 — 개요와 기능
  • 핵심 기능: 설치와 요구사항 — 시작하기
  • 실전·API: HybridFlow 프로그래밍 가이드 — 데이터플로 설계

출처: https://verl.readthedocs.io/en/latest/