GitHub
Cosmos-Predict2 소스 코드 및 문서
Hugging Face
Cosmos-Predict2 모델 컬렉션
Cosmos Predict2 텍스트 기반 이미지 생성
Cosmos-Predict2를 이용한 텍스트 기반 이미지 생성
Comfy Cloud에서 실행
강력한 GPU로 Comfy Cloud에서 Cosmos-Predict2 워크플로 실행
Cosmos Predict2 Video2World 워크플로
2B 버전을 테스트할 때 약 16GB VRAM이 필요합니다.1. 워크플로 파일
아래 비디오를 다운로드하여 ComfyUI에 드래그하면 워크플로가 로드됩니다. 워크플로에는 모델 다운로드 링크가 이미 포함되어 있습니다.Comfy Cloud에서 실행
사전 설치된 모델로 Comfy Cloud에서 이 워크플로 실행
워크플로 파일 다운로드
JSON 형식 워크플로 파일 다운로드
2. 수동 모델 설치
모델 다운로드가 성공하지 못한 경우, 이 섹션에서 직접 수동으로 다운로드할 수 있습니다. 확산 모델확산 모델
cosmos_predict2_2B_video2world_480p_16fps.safetensors
텍스트 인코더
oldt5_xxl_fp8_e4m3fn_scaled.safetensors
VAE
wan_2.1_vae.safetensors
3. 워크플로 단계별 완료

Load Diffusion Model노드가cosmos_predict2_2B_video2world_480p_16fps.safetensors를 로드했는지 확인합니다.Load CLIP노드가oldt5_xxl_fp8_e4m3fn_scaled.safetensors를 로드했는지 확인합니다.Load VAE노드가wan_2.1_vae.safetensors를 로드했는지 확인합니다.- 제공된 입력 이미지를
Load Image노드에 업로드합니다. - (선택사항) 첫 번째 및 마지막 프레임 제어가 필요하면 단축키
Ctrl(cmd) + B를 사용하여 마지막 프레임 입력을 활성화합니다. - (선택사항)
ClipTextEncode노드에서 프롬프트를 수정할 수 있습니다. - (선택사항)
CosmosPredict2ImageToVideoLatent노드에서 크기와 프레임 수를 조정합니다. Run버튼을 클릭하거나Ctrl(cmd) + Enter단축키를 눌러 워크플로를 실행합니다.- 생성이 완료되면 비디오가 자동으로
ComfyUI/output/디렉토리에 저장되며,save video노드에서 미리보기할 수 있습니다.