谷歌本周四宣布升级 Google Vids,引入多模态模型 Gemini Omni。用户可上传一张自拍和一段语音录音,生成外貌和声音相近的个人 AI 虚拟人,用于视频出镜表达。新版本还支持结合文字提示和参考图生成视频,并提供背景替换、光线修正、特效添加及渐进式编辑等功能。谷歌表示,该功能将纳入 Google Workspace,面向企业内部通知、培训等场景;个人虚拟人仅向特定地区年满18岁用户开放,并绑定账户真实身份,通过 SynthID 添加隐形水印以降低滥用风险。
谷歌本周四宣布升级 Google Vids,引入多模态模型 Gemini Omni。用户可上传一张自拍和一段语音录音,生成外貌和声音相近的个人 AI 虚拟人,用于视频出镜表达。新版本还支持结合文字提示和参考图生成视频,并提供背景替换、光线修正、特效添加及渐进式编辑等功能。谷歌表示,该功能将纳入 Google Workspace,面向企业内部通知、培训等场景;个人虚拟人仅向特定地区年满18岁用户开放,并绑定账户真实身份,通过 SynthID 添加隐形水印以降低滥用风险。