Gemini Omni 1.1 Flash
Gemini Omni 1.1 Flash 是一款专为专业工作流设计的生成式视频模型,通过 Gemini API 提供场景延伸、关键帧插值和 4K 上采样等高级创意控制功能,助力高效视频创作。
Gemini Omni 1.1 Flash 是一款专为专业工作流设计的生成式视频模型,通过 Gemini API 提供场景延伸、关键帧插值和 4K 上采样等高级创意控制功能,助力高效视频创作。
产品用途与官方定位
Gemini Omni 1.1 Flash 为开发者提供了一套用于创建、编辑和完善生成式视频内容的工具。该模型强调生产就绪的能力,允许对摄像机运动、叙事连续性和视觉一致性进行精确控制。
通过与 Google AI Studio 中的 Gemini API 和 Gemini Enterprise Agent Platform 集成,该模型支持通过轻量级 360p 预览进行快速原型设计,并支持高达 4K 分辨率的高保真最终渲染。
有官方来源支持的使用场景
开发者可以构建媒体编辑软件,利用场景延伸和帧插值功能协助创作者生成和完善复杂的视频序列。
该模型通过生成轻量级 360p 视频预览,实现高效的分镜脚本迭代,让团队在投入高分辨率渲染前对比不同版本。
官网提供的使用流程
利用 Gemini API,通过提供之前的交互 ID 和文本提示来生成后续素材,从而延续视频序列。
Gemini Omni 1.1 Flash 引入了特定机制来提高 AI 生成视频的可控性。通过允许用户定义镜头的起始帧和结束帧,该模型有助于实现复杂的摄像机运动(如环绕和缩放),同时保持视觉连贯性。
此外,该模型能够参考长达三秒的现有视频,这有助于确保角色和视觉风格在生成的片段中保持一致,解决了长篇 AI 叙事中的常见挑战。
用自己的素材和工作流完成验证
核对了哪些信息以及核对时间
基于已核对产品资料的回答
用户可以以 10 秒为增量延伸视频,总累积长度最高可达 40 秒,这为扩展叙事提供了极大的灵活性。
是的,该模型允许包含长达三秒的视频作为参考材料,以帮助在不同片段间维持视觉上下文和角色的一致性。
是的,Gemini Omni 1.1 Flash 能够生成 1080p 或 4K 分辨率的高质量视频,满足专业制作对清晰度的严苛要求。
生成 360p 预览可实现更快的原型设计和分镜迭代,因为这些文件的生成速度比 720p 快 60%,且成本更低。
开发者可以通过 Google AI Studio 中的 Gemini API 以及 Gemini Enterprise Agent Platform 访问该模型并开始构建。