Gemini Omni 1.1 Flash 让您以更强的控制力进行构建
内容提要
谷歌发布Gemini Omni 1.1 Flash,新增场景扩展、首尾帧指定、360p快速草稿、4K升级及视频参考等功能,支持开发者通过API制作专业视频。该模型可分析10秒上下文,扩展至40秒,并已集成至Adobe、Figma等平台,提升生成视频的连贯性和效率。
延伸解读
从“生成”到“导演”:控制力是关键
本次更新的核心不是单纯提升画质,而是赋予开发者更精细的“导演”能力。通过指定首尾帧、扩展场景、引用视频参考,创作者可以更精确地控制镜头运动、叙事连贯性和角色一致性。这标志着AI视频从“碰运气”式的生成,向可预期、可迭代的专业工作流迈进,尤其适合需要精确分镜和品牌一致性的商业场景。
成本与效率的平衡:360p草稿模式
新增的360p快速草稿模式,生成速度提升高达60%,成本仅为720p标准分辨率的三分之一。这一设计鼓励开发者进行快速原型验证和故事板迭代,在投入高成本制作前,先以低风险方式探索多种创意方向。对于需要频繁试错的工作流,这能显著降低时间和金钱成本,让创意探索更自由。
生态集成:从工具到平台
Gemini Omni 1.1 Flash已集成至Adobe Firefly、Figma Weave、Runway等主流创意平台,并可通过Agent Platform API供企业使用。这表明谷歌正致力于将模型嵌入创作者已有的工作流,而非要求他们迁移到新工具。对于开发者而言,这意味着可以借助现有生态快速触达用户,同时利用平台的数据和反馈优化模型表现。
Q&A
Gemini Omni 1.1 Flash 新增了哪些功能?
Gemini Omni 1.1 Flash 新增了场景扩展、首尾帧指定、360p快速草稿、4K升级以及视频参考等功能,旨在提升生成视频的连贯性和效率。
如何使用 Gemini API 扩展视频场景?
使用 Gemini API 扩展场景时,需要调用 client.interactions.create 方法,指定模型为 gemini-omni-1.1-flash,并传入 previous_interaction_id 作为上下文,同时输入文本指令如“Continue the scene.”,并可设置分辨率为 360p。
Gemini Omni 1.1 Flash 的场景扩展支持多长的上下文?
Gemini Omni 1.1 Flash 可以分析最多10秒的先前视频上下文,并支持以10秒为增量扩展,总时长可达40秒。
360p 快速草稿相比 720p 有哪些优势?
360p 快速草稿生成速度比 720p 快最多60%,成本仅为 720p 的三分之一,适合快速原型制作和故事板迭代。
Gemini Omni 1.1 Flash 支持哪些视频输出分辨率?
Gemini Omni 1.1 Flash 支持生成 360p、720p、1080p 以及 4K 分辨率的视频,其中 1080p 和 4K 适合专业制作。
视频参考功能有什么作用?
视频参考功能允许用户上传最多3秒的视频作为参考,以保持视觉上下文和角色一致性,例如让特定角色执行参考视频中的动作。
哪些平台已经集成了 Gemini Omni Flash?
Gemini Omni Flash 已集成到 Adobe Firefly、Figma Weave、Runway 等平台,并通过 GMI Cloud 提供访问。
开发者如何开始使用 Gemini Omni 1.1 Flash?
开发者可以通过 Google AI Studio 直接试用,或通过 Gemini Enterprise Agent Platform API 进行构建,同时可查阅官方文档、cookbook 和提示指南。