디퓨전 모델 쿡북 개요

디퓨전 모델 쿡북 개요 (Diffusion Overview)

SGLang으로 디퓨전(diffusion) 모델을 배포하고 사용하는 실용 레시피 모음입니다. 출력 모달리티(이미지/비디오/리얼타임·월드)별로 레시피를 고르게 되어 있어요. 사이드바는 모델 계열별로 정리되어 있습니다.

출처: 문서

본문

SGLang으로 디퓨전 모델을 배포·사용하는 실용 가이드.

출력 모달리티별로 레시피를 고르세요. 사이드바는 모델 계열별로 정리되지만, 이 개요는 이미지, 비디오, 리얼타임/월드 워크로드를 구분합니다.

이미지 모델 (Image Models)

이미지 모델은 하나의 요청을 유한한 디노이징(denoising) 작업으로 생성하며, 보통 전체 잠재(latent) 시퀀스에 걸쳐 양방향 어텐션(bidirectional attention)을 사용합니다.

비디오 모델 (Video Models)

비디오 모델은 각 요청에 대해 유한한 잠재 비디오 시퀀스를 디노이징합니다. 오프라인 텍스트-투-비디오, 이미지-투-비디오, 비디오 생성 서빙에 이 레시피를 사용하세요.

리얼타임 / 월드 모델 (Realtime / World Models)

리얼타임 모델은 세션을 유지하며 인과적 상태(causal state), 제어 신호(control signals), 캐시된 비디오 히스토리로 청크 단위로 생성합니다.

LingBot World 계열 변형은 사이드바 그룹을 사용하세요. 이 개요는 최신 LingBot World 2.0 레시피를 직접 연결합니다.

더 알아보기 (Learn more)