model 매개변수를 통해 두 가지 모델 변형을 지원합니다:
grok-imagine-video: 이전 세대 모델, 이미지 입력은 선택 사항grok-imagine-video-1.5: 최신 모델, 항상 입력 이미지 필요, 1080p 출력 지원
Grok Imagine Video 1.5가 뛰어난 점
- 이미지 기반 비디오 생성: 단일 입력 이미지에서 고품질 비디오를 생성합니다
- 기본 오디오: 음향 효과, 분위기, 대화가 동일한 추론 패스에서 합성되므로 별도의 오디오 파이프라인이 필요하지 않습니다
- 현실적인 움직임: 움직임이 생성된 오디오와 동기화된 상태를 유지합니다
- 최대 1080p 출력: 1.5 모델은 1080p 해상도를 지원합니다
- 유연한 재생 시간: 비디오 길이는 1초에서 15초까지 가능합니다
ComfyUI에서 사용하기
Grok Imagine Video 1.5 워크플로
ComfyUI에서 이미지 기반 비디오 생성 워크플로를 로컬 또는 Comfy Cloud에서 실행하세요