Google 正在为其视频创作工具 Google Vids 引入最新的 Gemini Omni 模型。这款工具自 2024 年首次推出以来,此次更新将赋予用户生成更高品质 AI 视频片段的能力,并允许用户仅通过简单的文字描述,即可对视频进行精准编辑。
此次更新为 Vids 带来了两大核心功能:首先,用户可利用科技巨头最新的 Omni Flash 模型生成全新的视频片段;其次,Gemini Omni 能够根据文字指令对现有视频进行修改。
Google 表示,与前代模型相比,新模型在文本渲染、物理规律模拟以及画面真实感等方面均有显著提升。在实际应用中,这意味着 AI 生成的视频片段将更具视觉美感,尤其是在视频包含可读文字或物体与环境产生交互的场景中,表现会更加自然逼真。
借助基于文本提示词的编辑功能,用户无需再手动操作繁琐的剪辑工具,只需直接向 Gemini Omni 提出具体的修改需求。例如,用户可以指令其修正视频的色彩分级、将视频转换为动漫风格,或是消除背景中不需要的杂音(如警笛声)。这使得 Gemini Omni 的价值不仅限于从零生成视频,还能针对现有内容进行定向优化与调整。
在适用范围方面,Google Vids 中的 Gemini Omni 功能覆盖了多种 Google Workspace 订阅计划,包括 Business(Starter、Standard 和 Plus)、Enterprise(Starter、Standard、Plus、Essentials 和 Essentials Plus)、Education Plus 以及 Non-profits(非营利组织)计划。
此外,Google AI Pro 和 Ultra 的个人订阅用户,以及部分教育附加组件用户也可使用该功能。对于购买了 AI Expanded Access(AI 扩展访问)附加许可证的用户,其在 Vids 中使用 Gemini Omni 的额度上限将得到进一步提升。
不过,该功能在首发阶段存在一定的地域限制。在欧洲经济区、瑞士、英国,以及美国的得克萨斯州和伊利诺伊州,Gemini Omni 暂不支持对非 AI 生成的视频进行编辑。
该功能目前正在逐步推送中。Google 表示,使用“快速发布”域的用户预计从今天起即可开始体验,整个推送过程最长需要 15 天;而针对“定期发布”域的推送则计划于 8 月 5 日启动,同样预计需要 15 天完成。