星光澄海 | BLOG

Gemini 3.8 Live的虚拟形象:谷歌AI终于有了实时脸

你试过跟AI聊天,只盯着文字框跳字吗?Google刚给Gemini 3.8 Live加了个“脸”——Live Avatar,但现在只有企业客户能碰。

仅限企业客户的“AI脸”

Gemini 3.8 Live的这个更新,核心就是加了实时虚拟形象功能。用户跟AI对话时,能看到动画化的AI分身同步回应:对口型、换表情都跟着对话节奏走。但这个功能不是全量开放,目前只对Gemini Enterprise的企业级客户提供,普通消费者暂时还用不上。

97种语言的口型:Google没搞砸

Google特意提到了Live Avatar的语言覆盖:它支持97种语言,而且不会降低视频画质,也不会出现视觉漂移的问题。官方放的演示视频里,这个虚拟形象说英语和日语时,口型都跟台词精准对齐,没有那种“嘴型跟声音不搭”的违和感。之前不少多语言AI的虚拟形象,要么口型是硬套的模板,要么画质糊得看不清,这次Google好像在这部分踩中了点。

AI的脸,不是单纯的装饰

这个功能的意义不在“好看”,而在交互的变化。对Google来说,给AI加实时同步的视觉反馈,主要是为了强化企业端的场景——比如企业用Gemini做客服,用户跟AI聊业务时,能看到对应虚拟形象,会比纯文字对话更有真实感。对行业来说,这算是AI交互从“单模态输出”(要么文字要么语音)往“多模态同步”走的一小步,但目前还停留在企业级,没到大众消费端。

说到底,这个功能的核心是让AI的回应有了更自然的载体,但如果未来它下放给普通用户,你会愿意对着虚拟形象聊天,还是依然偏好安静的文字对话?


素材来源:The Verge AI · AI情报、大模型、消费级AI
查看报道原文

发表第一条评论吧

支持 Markdown