News
Gemini Omni 1.1 Flash lets you build with more control
Anish Nangia
2026.08.28
·Web·by igor#AI Tools#Gemini#Generative AI#Google AI#Video Generation
핵심 포인트
- 1Google은 개발자가 동영상을 확장하고 시작과 끝 프레임을 지정하며 4K 고해상도로 업스케일링할 수 있는 Gemini Omni 1.1 Flash 모델을 새롭게 발표했습니다.
- 2이 모델은 최대 10초의 이전 문맥을 분석하여 40초까지 장면을 매끄럽게 연결하고, 360p 해상도 옵션을 통해 프로토타이핑 과정에서 비용과 시간을 효율적으로 절감할 수 있게 합니다.
- 3현재 이 기술은 Google AI Studio 및 Gemini Enterprise Agent Platform을 통해 제공되며, Adobe Firefly나 Figma Weave 등 다양한 플랫폼에서 전문적인 영상 제작 워크플로우를 지원합니다.
Gemini Omni 1.1 Flash는 개발자를 위한 프로덕션급 생성형 비디오 업데이트로, 비디오 제어 능력과 워크플로우 효율성을 극대화한 모델입니다. 주요 기능과 방법론은 다음과 같습니다.
핵심 기능 및 방법론
- Scene Extension (장면 확장)
- 기존 모델이 마지막 1초의 문맥만 참조하던 것과 달리, Gemini Omni 1.1 Flash는 최대 10초의 이전 문맥을 분석하여 일관성 있는 영상 생성이 가능합니다.
- 최대 40초까지 10초 단위로 장면을 점진적으로 확장할 수 있으며, 내러티브의 흐름을 유지하며 새로운 방향으로 분기할 수 있습니다.
- Keyframe-based Transitions (첫 번째 및 마지막 프레임 지정)
- 시작 프레임과 종료 프레임을 사용자가 직접 지정하여, 두 지점 사이의 연속적인 비디오를 생성합니다.
- 이를 통해 복잡한 카메라 궤도 이동(orbital rotation), 줌 전환, 심리스 루핑(seamless looping) 등의 전문적인 카메라 연출을 구현할 수 있습니다.
- Efficiency and Prototyping (360p 초안 작성)
- 720p 표준 해상도 대비 최대 60% 빠른 생성 속도와 1/3 수준의 비용으로 360p 해상도의 프리뷰 생성을 지원합니다.
- 이는 스토리보드 반복 작업 및 빠른 아이디어 검증에 최적화된 워크플로우를 제공합니다.
- Upscaling and Fidelity (4K 업스케일링 및 참조 제어)
- 최종 결과물을 1080p 또는 4K 해상도로 업스케일링하여 프로덕션 수준의 품질을 확보할 수 있습니다.
- Multimodal Input을 통해 최대 3초의 비디오 참조 자료를 입력할 수 있으며, 특정 캐릭터나 동작을 유지하면서 새로운 환경에 합성하는 정교한 제어가 가능합니다.
기술적 구현 방식
- API 통합:
google.genai클라이언트를 통해previous_interaction_id를 전달함으로써 컨텍스트를 유지한 채 비디오 생성을 이어갈 수 있습니다. - 성능 최적화: (생성 시간 기준) 및 비용 효율성을 통해 실시간 인터랙티브 환경에서의 활용성을 증대시켰습니다.
활용 및 생태계
- Adobe Firefly, Figma Weave, Runway, GMI Cloud 등 주요 플랫폼과의 통합을 통해 창작자가 비디오를 단순히 생성하는 단계를 넘어 직접적으로 연출(directing)할 수 있는 환경을 제공합니다.
- Google AI Studio 및 Gemini Enterprise Agent Platform을 통해 즉시 빌드가 가능하며, 복잡한 비디오 시퀀스 생성, 편집 소프트웨어 개발 및 미디어 워크플로우 자동화에 활용됩니다.