Google DeepMind 在官方博客发布题为《Introducing Gemini 3.8 Live with Live Avatar》的文章,宣布推出 Gemini 3.8 Live,并为其引入名为 Live Avatar 的新功能。截至现有公开信息,官方除标题外尚未给出该版本的详细技术说明、性能数据或可用范围。
从命名看,Gemini 3.8 Live 属于 Gemini Live 系列的新版本,该系列面向实时交互场景;新增的 Live Avatar 则指向在实时对话中引入“化身”形态的交互能力。两者结合,意味着模型侧的实时多模态交互可能进一步向可呈现的形象延伸,而不再局限于文本或语音层面的往返。
对 AI 从业者而言,这一发布值得关注的原因在于:实时语音与多模态对话长期是模型厂商的竞争焦点,而 Avatar 一旦成为模型层原生能力,将直接影响实时助手、客服、在线教育、虚拟主播等下游应用的构建方式——开发者或许不必再自行拼接语音识别、动画驱动与对话模型等多个环节,而可以在同一模型接口内完成。
目前,该功能的模型架构、延迟表现、接入方式与开放范围,均需以 DeepMind 官方博客及后续文档为准,尚不宜过度解读。
