Model Update2026-09-25
The Verge
谷歌Gemini 3.8 Live上线会动的数字人形象
谷歌在 Gemini 3.8 Live 更新里加了个能动的「Live Avatar」(实时数字人)。用户一边跟模型说话,一边看着屏幕上这个虚拟形象实时回应——嘴型跟着语音走,对话过程中还会做出各种表情。比起只看到一片空白或者一条声波,现在至少有个「人」在那儿跟你聊,语音交互一下子多了层看得见的人味儿。
不过目前这项功能只对 Gemini Enterprise 企业客户开放。这说明谷歌想先在商用场景里试水——客服、培训、虚拟助理、企业内部知识库这类地方,而不是普通消费者的聊天窗口。企业端的需求确实更明确:客服可以用数字人给出统一口径的答复,培训模块可以让它当陪练,虚拟助理可以带着员工一步步操作复杂软件。有个面孔在,语音 AI 可能更抓人、也更容易被信任,但期待值也会跟着上去——表情要是跟说的话对不上,用户反而会觉得别扭甚至发毛。
现实问题也有一堆。实时对口型和面部动画都要额外算力,延迟和成本都会往上走。企业会想知道:这东西到底是真能提高任务完成率,还是只是看着新鲜?隐私和告知同样关键,跟 AI 打交道的人应该清楚对面这个「人」是合成的,尤其是在面对客户的岗位上。
谷歌从企业客户切入,等于给自己找了个可控的环境先收反馈,再考虑更大范围铺开。这次更新其实也是整个行业在比谁家的助手更「多模态」、更能读懂情绪。只有声音会让人觉得飘,有张会动的脸就更像在正常交流。但值不值,最终还得看准确率、响应速度,以及企业能不能在不让用户困惑或被误导的前提下把它用起来。说白了,Live Avatar 不太像一次模型能力升级,更像加了一层新界面——而这一层,可能会重塑人们在职场里跟 AI 说话的方式。