Google Vids 引入 AI 智能化:从文本生成到虚拟出镜

Google Vids 推出 Gemini Omni 和个人化身功能,允许用户通过自然语言生成和编辑视频,甚至无需出镜即可创建虚拟替身,大幅降低视频创作门槛。
Google Vids 引入 AI 智能化:从文本生成到虚拟出镜
对于开发者和内容创作者而言,视频制作往往伴随着繁琐的剪辑工作、对镜头的紧张感以及素材匮乏的痛点。为了解决这些问题,Google 在 2026 年 7 月对旗下的视频协作工具 Google Vids 进行了重大更新,引入了 Gemini Omni 和 个人化身 两大核心功能。这标志着视频创作正在从“技术驱动”向“自然语言驱动”转型。
一、 Gemini Omni:用自然语言“画”出视频
过去,想要制作一个高质量的视频,不仅需要专业的设备,还需要掌握复杂的剪辑软件操作。现在,Gemini Omni 的引入彻底改变了这一局面。它利用生成式 AI 技术,让用户只需输入简单的文字描述或提供参考图片,就能生成相应的视频片段。
核心功能与实用解读:
- 混合输入生成: 用户不仅可以输入自然语言提示词,还可以上传一张照片或草图作为参考。AI 会将这些视觉元素与文本描述结合,生成更符合预期的视频内容。
- 降低门槛: 对于不懂剪辑的 AI 爱好者或忙碌的专业人士来说,这是一个巨大的福音。你只需要描述“我想看一个阳光明媚的海滩”,AI 就能帮你完成画面构建。
二、 聊天式编辑:无需重拍,只需描述
视频创作往往是一个迭代的过程。在旧模式下,修改一个镜头可能需要重新拍摄素材,或者花费大量时间在时间轴上拖拽素材。Google Vids 现在支持通过 “聊天式编辑” 来解决这个问题。
核心功能与实用解读:
- 描述即修改: 无论你是通过 AI 生成的视频,还是用手机拍摄的素材,都可以直接用日常语言告诉 Vids 你想改什么。例如:“把背景换成办公室”、“把灯光调暖一点”或“增加某种特效”。
- 步骤化操作: 系统支持分步修改,这意味着你不需要从头开始剪辑,只需针对不满意的部分进行微调,极大地提高了修改效率。
三、 个人化身:不想出镜?AI 帮你说话
很多视频创作者因为害怕面对镜头或时间紧张,而不愿录制真人出镜的视频。Google Vids 新增的 个人化身 功能,为这部分用户提供了完美的解决方案。
核心功能与实用解读:
- 数字替身: 用户只需上传一张自己的自拍和一段简短的语音录音。系统会利用 AI 技术生成一个与用户外貌和声音高度相似的数字化身。
- 零录制成本: 生成化身后,用户只需输入想说的文字,化身就会自动替你“说话”并出现在视频中。这对于发布每日更新、个人问候或不需要真人出镜的教程视频非常有价值。
四、 透明度与未来展望
为了保持内容的可信度,Google 为所有由 AI 生成的视频片段添加了数字水印。这不仅是对创作者版权的保护,也是对观众的一种透明度承诺。
总结: Google Vids 的这两项更新(Gemini Omni 和个人化身)正在将视频制作工具变得前所未有的简单。它不再要求用户具备专业的视频工程能力,而是要求用户具备清晰的创意构思能力。对于开发者而言,这展示了 AI 如何无缝集成到生产力工具中,重塑工作流;对于普通用户,这则是人人都能成为导演的时代。
本文基于 Google AI Blog 的公开内容,由 AI 辅助整理改写后发布。
原标题:Create, edit and star in videos with two Google Vids updates
阅读原文