Skip to main content
Gemini Omni Flash는 Google DeepMind의 고품질, 비용 효율적인 비디오 생성 및 대화형 편집 모델입니다. Google I/O 2026에서 Gemini Omni 제품군의 일부로 처음 소개되었으며, Gemini의 멀티모달 추론과 네이티브 비디오 생성을 결합하여 개발자가 자연어 대화를 통해 비디오를 생성, 편집 및 리믹스할 수 있도록 합니다.

Gemini Omni Flash의 강점

  • 대화형 비디오 편집: 자연어를 사용하여 비디오를 다듬고 편집하세요. 캐릭터 교체, 장면 조명 변경, 각도 변경, 객체 추가 또는 제거를 수행하면서 원본 오디오 및 비디오 트랙을 유지합니다.
  • 멀티모달 입력: 텍스트, 이미지 및 비디오 입력을 결합하여 생성을 안내합니다. 모든 비디오 출력에 동기화된 오디오를 기본적으로 생성합니다.
  • 세계 지식 및 시뮬레이션: 물리 이해와 Gemini의 역사, 과학 및 문화적 맥락에 대한 지식을 결합하여 사실적 표현을 넘어 의미 있는 스토리텔링을 가능하게 합니다.
  • 텍스트 및 동작 동기화: 읽기 쉬운 텍스트와 그래픽을 비디오에 직접 렌더링하여 동적 타이포그래피를 화면 움직임과 동기화합니다.
  • 가격: 비디오 출력 초당 $0.10이며, Veo 3.1 Fast 가격과 동일합니다.

ComfyUI에서 사용하기

Gemini Omni Flash 워크플로

ComfyUI에서 로컬 또는 Comfy Cloud에서 텍스트 기반 비디오 생성, 이미지 기반 비디오 생성 및 비디오 편집 워크플로를 실행하세요.