Gemini Omni 1.1 Flash: ComfyUI 에서 제어 가능한 비디오 생성 가능

ComfyUI Wikinews

ComfyUI 는 텍스트 기반 비디오 생성, 이미지 기반 비디오 생성, 레퍼런스 기반 비디오 생성, 장면 확장, 그리고 4K 출력 지원 비디오 편집을 포함하는 다섯 가지 Gemini Omni 1.1 Flash API 노드를 추가했습니다.

Gemini Omni 1.1 Flash는 Google DeepMind 의 Gemini Omni Flash 비디오 모델 패밀리에 대한 프로덕션 준비 완료 업데이트로, ComfyUI 에서 다섯 가지 API 노드 (Google announcement, model card) 를 통해 제공됩니다.

2026 년 8 월 27 일 Gemini API 에서 일반 공개된 모델인 Omni 1.1 Flash 는 개발자 제어를 중점으로 합니다: 장면을 확장하고, 부드러운 전환을 위해 시작 및 종료 프레임을 지정하며, 고해상도로 출력을 생성할 수 있습니다.

Gemini Omni 1.1 Flash

Google 블로그의 Gemini Omni 1.1 Flash 발표 시각 자료

ComfyUI 의 다섯 가지 노드

  • 텍스트 기반 비디오 생성: 업데이트된 모델을 통한 프롬프트 기반 생성.
  • 이미지 기반 비디오 생성: 정지 이미지를 애니메이트합니다.
  • 레퍼런스 기반 비디오 생성: 레퍼런스 에셋에서 생성합니다.
  • 장면 확장: 기존 클립을 계속하여 최대 40 초까지 생성된 샷을 시퀀스로 연결합니다.
  • 비디오 편집: 나머지 영상은 안정적으로 유지하면서 콘텐츠를 변경하는 대화형 편집입니다.

업데이트된 모델은 샷 간 제어가 가능한 전환을 위한 첫 번째 및 마지막 프레임 지정 기능을 추가했으며, 최대 4K 해상도 출력을 지원합니다.

사용 방법

ComfyUI 를 최신 빌드로 업데이트한 후, Google 파트너 섹션의 노드 라이브러리에서 Gemini 노드를 찾거나 공식 템플릿을 로드합니다. 템플릿은 t2v, i2v, r2v, extend, edit 변형을 포함한 모든 다섯 워크플로우에 제공됩니다.

생성은 API 노드 시스템을 통해 Google 서버에서 실행됩니다: 로컬 가중치는 관여하지 않으며, 청구는 Gemini API 가격을 따릅니다.

댓글

GitHub로 로그인하고 토론에 참여하세요.

댓글을 불러오는 중…
Gemini Omni 1.1 Flash: ComfyUI 에서 제어 가능한 비디오 생성 가능 | ComfyUI Wiki