Skip to main content
Grok Imagine Video 1.5 Partner Node는 단일 이미지 입력으로 기본 오디오가 포함된 고품질 비디오를 생성합니다. xAI의 최신 Grok 모델로 구동되며, 현실적인 움직임과 동기화된 오디오를 생성하고 최대 1080p 해상도를 지원합니다. 노드는 model 매개변수를 통해 두 가지 모델 변형을 지원합니다:
  • grok-imagine-video: 이전 세대 모델, 이미지 입력은 선택 사항
  • grok-imagine-video-1.5: 최신 모델, 항상 입력 이미지 필요, 1080p 출력 지원
두 변형 모두 기본 오디오를 생성하여 음향 효과, 분위기, 대화가 동일한 추론 패스에서 합성되므로 별도의 오디오 파이프라인이 필요하지 않습니다. 비디오 길이는 1초에서 15초 사이입니다.

Grok Imagine Video 1.5가 뛰어난 점

  • 이미지 기반 비디오 생성: 단일 입력 이미지에서 고품질 비디오를 생성합니다
  • 기본 오디오: 음향 효과, 분위기, 대화가 동일한 추론 패스에서 합성되므로 별도의 오디오 파이프라인이 필요하지 않습니다
  • 현실적인 움직임: 움직임이 생성된 오디오와 동기화된 상태를 유지합니다
  • 최대 1080p 출력: 1.5 모델은 1080p 해상도를 지원합니다
  • 유연한 재생 시간: 비디오 길이는 1초에서 15초까지 가능합니다

ComfyUI에서 사용하기

Grok Imagine Video 1.5 워크플로

ComfyUI에서 이미지 기반 비디오 생성 워크플로를 로컬 또는 Comfy Cloud에서 실행하세요