Google 的视频工具 Vids7月16日 获得迄今最具个人色彩的新功能:用户本人的 AI 数字分身。这一功能由一张自拍和一段简短的语音录音生成,能够在镜头前朗读任意脚本——无需拍摄、无需补录,也无需面对镜头紧张。

工作原理

用户上传一张自拍并录制一段简短的语音样本;Vids 会生成一个看起来和听起来都像用户本人的数字分身,随时准备呈现所提供的任何脚本。其显而易见的应用场景,是企业视频中并不光鲜但至关重要的部分:培训模块、产品演示、入职引导片和公告视频。过去这些内容要么需要真人出镜表演,要么需要外包制作。

安全边界

Google 对同意边界划定得很严格。数字分身仅限于账户持有者本人的形象,并与 Google Account 绑定;该功能仅面向18 岁及以上用户,在部分地区可用,而且每段生成视频都带有不可见的 SynthID 水印用于溯源检测。设计目标十分明确:把自我拟像作为生产力功能,而在账户层面排除对第三方的冒用。

Gemini Omni 加入

除了数字分身,Google 的 Gemini Omni 生成模型也将进入 Vids,带来基于提示词的创建和编辑能力:可根据文字描述和参考图片制作视频、替换背景、修正手机拍摄素材的光线并应用特效——还支持分步骤迭代编辑,无需从头开始即可逐步优化视频。

适用对象

这些功能将向 Google AI Pro 和 Ultra 订阅用户以及 Workspace 企业客户推送。此举也从平台层面对 HeyGen 和 Synthesia 等专注数字分身的供应商形成挤压:Google 把这些公司作为产品出售的能力,直接打包进了目标客户原本就已付费的 Workspace 体系中——TechCrunch 对此的判断是,Vids 正越来越像一个一体化视频平台,而不再只是演示工具,这一说法如今看来几乎是字面意义上的准确。