据 The Verge 报道,Google 将把名为 Live Avatar 的功能带入 Gemini 3.8 Live,为这家公司的 AI 加上一张可被看见的“面孔”。这是 Gemini 实时对话体验的一次形态扩展:此前这类交互主要依赖语音与文字,如今多了一层视觉化的形象载体。
对 AI 从业者来说,值得关注的点大致有三层。
第一,交互界面的迁移。语音助手的能力再强,用户感知到的仍然只是“一段声音”。Live Avatar 把模型输出映射到一个可见的形象上,意味着响应延迟、打断、轮次切换这些工程指标,会直接转化为用户看到的动作与神态是否自然。体验的门槛从“听清”变成“看得顺”。
第二,产品定位的偏移。当 AI 有了面孔,它与用户的关系便从工具型调用滑向陪伴与代理。表情、神态、注视方向这类非语言信号,会承担一部分原本由文案和提示语完成的工作,也会改变用户对模型“人格”的预期。
第三,多模态竞争的下一站。文本、图像、音频的输入输出已趋于常规,视觉形象层是新的差异化空间,考验的是模型实时性、渲染管线与端侧算力的协同。
需要说明的是,目前公开信息仅涉及功能名称与版本对应关系,Live Avatar 的具体形态、覆盖范围与推出节奏尚未明确。它究竟是一个轻量的对话头像,还是一套完整的虚拟人系统,将决定这项功能是交互上的小修饰,还是 Google 在 AI 助手人格化方向上的一次正式押注。
