返回列表
谷歌Gemini 3.8 Live上线Live Avatar:为AI赋予实时动态面孔
产品发布谷歌Gemini虚拟数字人

谷歌Gemini 3.8 Live上线Live Avatar:为AI赋予实时动态面孔

谷歌正式推出Gemini 3.8 Live更新,新增Live Avatar实时虚拟形象功能。该功能为AI赋予了动态面孔,不仅能在对话中实时呈现唇形同步与丰富面部表情,还支持在97种状态间流畅转换。目前该功能仅面向Gemini Enterprise企业客户开放,开启了更具拟人感的实时AI交互新形态。

The Verge

核心要点

  • 全新多模态交互形态:谷歌推出 Gemini 3.8 Live 更新,正式引入“Live Avatar”(实时虚拟形象)功能,为 AI 赋予了可视化的动态面孔。
  • 唇形同步与生动表情:该虚拟形象能够在对话进行时,实现实时的唇形同步(Lip-sync),并呈现出多种不同的面部表情反应。
  • 状态转换特性:根据谷歌的说明,Live Avatar 具备在 97 种状态之间进行过渡和转换的动态渲染能力。
  • 企业版独家支持:目前该功能并非面向所有公众开放,而是仅面向 Gemini Enterprise(企业版)客户提供。

详细分析

实时虚拟形象打造拟人化对话体验

在本次 Gemini 3.8 Live 的功能升级中,谷歌将人机交互从单纯的文字或语音流进一步升级为兼具视觉呈现的多模态交互。借助 Live Avatar 功能,用户在与模型展开即时交流的同时,可以实时观看动画 AI 形象做出回应。该虚拟形象能够做到精准的实时唇形同步,并伴随对话语境展现出丰富的面部表情变化。这种视觉层面的动态表达,使人工智能从一个“只闻其声”的语音助手转变为一个拥有具体面容与动态表现的交互对象,大幅提升了互动的临场感与拟人化程度。

97种状态无缝过渡的技术展现

根据谷歌官方公布的技术特性,Live Avatar 具备在 97 种特定状态之间进行流畅过渡与切换的能力。虽然初始发布中对具体细节保持了精炼的披露,但这表明该系统在处理面部微表情、姿态变换和情绪渲染时具备深度的控制能力。通过在数十种预设或生成的动态状态间自如切换,Live Avatar 能够有效避免传统虚拟人交互常见的僵硬与生涩感,确保形象在做出即时回答时展现出自然、连续的视觉动态。

企业级定位与商用场景落地

值得注意的是,Live Avatar 当前被明确限定在 Gemini Enterprise 客户中使用。这一市场策略表明,谷歌优先将具备高度拟人化与视觉互动能力的技术投向企业级商业场景。在企业客服、智能接待、内部培训以及专属数字化品牌形象等需求日益增长的背景下,为企业提供带有生动面孔的 AI 代理,有助于企业塑造更具亲和力与专业感的客户交互窗口,加速推动高阶数字人在商业环境中的实际部署与应用。

行业影响

Gemini 3.8 Live 及其 Live Avatar 的亮相,标志着主流大模型正在加速迈入“声音+视觉形象”一体化实时交互的新阶段。过去业界多模态模型的角逐重点多集中于理解与图文生成,而实时动画数字人的直接集成,意味着实时渲染、语音生成与大语言模型的融合已经达到可实用化的工业级门槛。随着谷歌率先向企业级市场推送这一功能,预计将进一步催化整个行业在具象化 AI 代理与实时沉浸式交互层面的研发与商用竞逐。

常见问题

什么是 Gemini 3.8 Live 的 Live Avatar 功能?

Live Avatar 是谷歌在 Gemini 3.8 Live 中推出的一项实时虚拟形象更新。它让用户在与 AI 模型对话的过程中,能够实时看到一个具备唇形同步以及丰富面部表情变化的动画形象做出回应。

普通用户现在可以使用 Live Avatar 吗?

目前普通用户无法使用。根据官方信息,该功能当前仅面向 Gemini Enterprise(企业版)客户开放。

Live Avatar 在视觉表现上有何特点?

Live Avatar 支持在对话过程中实现实时的唇形同步与多种面部表情展示,同时谷歌指出其具备在 97 种相关状态之间进行平滑过渡转换的能力。

相关新闻