谷歌近日推出了全新的Gemini 3.8 Live更新,让用户能够在与模型对话时,观看一个动画AI形象实时做出回应。这项名为"Live Avatar"(实时虚拟形象)的功能可以进行唇形同步,并在对话过程中展现出不同的面部表情,不过目前该功能仅面向Gemini Enterprise企业客户开放。
据谷歌介绍,Live Avatar能够在其支持的97种语言之间自由切换,"且不会降低视频保真度或产生视觉漂移"。谷歌分享的一段视频展示了其Live Avatar分别用英语和日语对话的场景,无论使用哪种语言,虚拟形象的嘴部动画都能与所说内容精准对应。此外,该功能还能在对话过程中于屏幕上调取相关信息进行展示。
Live Avatar的发布距离谷歌公布全新的Gemini 3.8 Live模型仅一周左右时间,谷歌表示该模型"能够以接近实时的速度处理视觉输入"。谷歌将为企业客户提供一系列预设虚拟形象供其选择,同时也允许企业自行创建专属形象。谷歌表示,Live Avatar输出的内容都会附带隐形的SynthID水印,并配备相应的安全保障措施,以"尊重身份"信息。
Q&A
Q1:Gemini 3.8 Live的Live Avatar功能是什么?
A:Live Avatar是谷歌Gemini 3.8 Live更新中推出的一项功能,可以让用户在对话时看到一个动画AI形象实时做出回应,具备唇形同步和面部表情展示能力。
Q2:Live Avatar支持哪些语言?效果如何?
A:Live Avatar支持97种语言之间的切换,且切换过程中不会降低视频质量或出现视觉漂移,嘴部动画能与不同语言的发音精准对应。
Q3:普通用户现在能使用Live Avatar吗?
A:目前该功能仅面向Gemini Enterprise企业客户开放,谷歌提供预设虚拟形象库,同时也支持企业创建自己专属的虚拟形象。
