- 핵심 아키텍처: Sora와 유사한 DiT(Diffusion Transformer) 아키텍처를 사용하며, 텍스트, 이미지, 모션 정보를 효과적으로 융합해 생성된 비디오 프레임 간의 일관성, 품질 및 정렬성을 향상시킵니다. 통합된 풀 어텐션 메커니즘은 다중 뷰 카메라 전환을 가능하게 하면서도 주제의 일관성을 보장합니다.
- 3D VAE: 맞춤형 3D VAE는 비디오를 압축된 잠재공간으로 변환해 이미지-투-비디오 생성을 더욱 효율적으로 만듭니다.
- 우수한 이미지-비디오-텍스트 정렬성: 이미지와 비디오 생성 모두에 뛰어난 MLLM 텍스트 인코더를 활용해 텍스트 지침을 더 잘 따르고, 세부사항을 포착하며 복잡한 추론을 수행합니다.
모든 워크플로우에 공통되는 모델
다음 모델들은 텍스트-투-비디오와 이미지-투-비디오 워크플로우 모두에 사용됩니다. 아래 모델들을 다운로드하여 지정된 디렉토리에 저장해주세요: 저장 위치:훈위안 텍스트-투-비디오 워크플로우
훈위안 텍스트-투-비디오는 2024년 12월에 오픈소스화되었으며, 중국어와 영어로 된 자연어 설명을 통해 5초짜리 짧은 비디오 생성을 지원합니다.1. 워크플로우
아래 워크플로우 이미지를 다운로드하여 ComfyUI로 드래그해 워크플로우를 로드하세요:
Comfy Cloud에서 실행
Comfy Cloud에서 열기
워크플로우 다운로드
JSON 다운로드 또는 템플릿 라이브러리에서 “Hunyuan Video” 검색
2. 수동 모델 설치
확산 모델: hunyuan_video_t2v_720p_bf16.safetensors
ComfyUI/models/diffusion_models에 저장
3. 워크플로우 실행 단계

DualCLIPLoader노드가 다음 모델을 로드했는지 확인하세요:- clip_name1: clip_l.safetensors
- clip_name2: llava_llama3_fp8_scaled.safetensors
Load Diffusion Model노드가hunyuan_video_t2v_720p_bf16.safetensors를 로드했는지 확인하세요.Load VAE노드가hunyuan_video_vae_bf16.safetensors를 로드했는지 확인하세요.Queue버튼을 클릭하거나 단축키Ctrl(cmd) + Enter를 사용해 워크플로우를 실행하세요.
Hunyuan 이미지 기반 비디오 생성 워크플로
Hunyuan 이미지 기반 비디오 생성 모델은 HunyuanVideo 프레임워크를 기반으로 하며, 2025년 3월 6일에 오픈소스로 공개되었습니다. 이 모델은 정적 이미지를 부드럽고 고품질의 비디오로 변환하며, 모발 성장, 객체 변형 등과 같은 특수 비디오 효과를 사용자 정의할 수 있는 LoRA 학습 코드도 제공합니다. 현재 Hunyuan 이미지 기반 비디오 생성 모델에는 두 가지 버전이 있습니다:- v1 “concat”: 모션 유동성은 더 좋지만 이미지 가이드 준수도는 낮습니다
- v2 “replace”: v1 공개 다음 날 업데이트 되었으며, 이미지 가이드 준수도는 더 좋지만 v1에 비해 덜 역동적으로 보입니다
v1 “concat”

v2 “replace”

v1 및 v2 버전 공용 모델
CLIP Vision: llava_llama3_vision.safetensors
ComfyUI/models/clip_vision에 저장하세요
V1 “concat” 이미지 기반 비디오 생성 워크플로
1. 워크플로 및 에셋
아래 워크플로 이미지를 다운로드하여 ComfyUI로 드래그하면 워크플로가 로드됩니다:
워크플로 다운로드
워크플로 이미지를 다운로드하여 ComfyUI로 드래그하세요
시작 프레임: robot-ballet.png
I2V 생성용 입력 이미지로 저장하고 사용하세요
2. 관련 모델 수동 설치
확산 모델: hunyuan_video_image_to_video_720p_bf16.safetensors
ComfyUI/models/diffusion_models에 저장하세요
3. 워크플로 실행 단계

DualCLIPLoader에서 다음 모델을 로드했는지 확인하세요:- clip_name1: clip_l.safetensors
- clip_name2: llava_llama3_fp8_scaled.safetensors
Load CLIP Vision에서llava_llama3_vision.safetensors를 로드했는지 확인하세요Load Image Model에서hunyuan_video_image_to_video_720p_bf16.safetensors를 로드했는지 확인하세요Load VAE에서vae_name: hunyuan_video_vae_bf16.safetensors를 로드했는지 확인하세요Load Diffusion Model에서hunyuan_video_image_to_video_720p_bf16.safetensors를 로드했는지 확인하세요Queue버튼을 클릭하거나 단축키Ctrl(cmd) + Enter를 사용하여 워크플로를 실행하세요
v2 “replace” 이미지 기반 비디오 생성 워크플로
v2 워크플로는 기본적으로 v1 워크플로와 동일합니다. replace 모델을 다운로드하여Load Diffusion Model 노드에서 사용하기만 하면 됩니다.
1. 워크플로 및 에셋
아래 워크플로 이미지를 다운로드하여 ComfyUI로 드래그하면 워크플로가 로드됩니다:
워크플로 다운로드
워크플로 이미지를 다운로드하여 ComfyUI로 드래그하세요
시작 프레임: flux_dev_example.png
저장하고 I2V 생성용 입력 이미지로 사용하세요
2. 관련 모델 수동 설치
확산 모델: hunyuan_video_v2_replace_image_to_video_720p_bf16.safetensors
ComfyUI/models/diffusion_models에 저장하세요
3. 워크플로 실행 단계

DualCLIPLoader노드에 다음 모델이 로드되었는지 확인하세요:- clip_name1: clip_l.safetensors
- clip_name2: llava_llama3_fp8_scaled.safetensors
Load CLIP Vision노드에llava_llama3_vision.safetensors가 로드되었는지 확인하세요Load Image Model노드에hunyuan_video_image_to_video_720p_bf16.safetensors가 로드되었는지 확인하세요Load VAE노드에hunyuan_video_vae_bf16.safetensors가 로드되었는지 확인하세요Load Diffusion Model노드에hunyuan_video_v2_replace_image_to_video_720p_bf16.safetensors가 로드되었는지 확인하세요Queue버튼을 클릭하거나 단축키Ctrl(cmd) + Enter를 눌러 워크플로를 실행하세요
Try It Yourself
Here are some images and prompts we provide. Use them as-is or adjust to create your own video.


