跳到正文
  1. Google DeepMind74

    Google DeepMind 发布 Gemini 3.8 Live with Live Avatar

    Google DeepMind 发布 Gemini 3.8 Live with Live Avatar,把近实时视频生成与语音结合,为 Gemini 的实时对话模型带来视觉形象。

    推荐理由:官方给出 Live Avatar 在对话中实时生成视频与语音的能力,读者可据此评估企业虚拟客服的交互形态变化。

  1. Google DeepMind72

    Google DeepMind 发布 Gemini 3.8 Flash TTS 与 Flash-Lite TTS

    Google DeepMind 发布 Gemini 3.8 Flash TTS 和 Gemini 3.8 Flash-Lite TTS 两款文本转语音模型,前者面向深度创作与角色设计,后者面向高并发、低成本场景。

    推荐理由:官方给出两款 TTS 模型的语音定制能力、基准排名和上线渠道,可据此判断多语言语音生成的可用性。

  1. Google DeepMind77

    Google DeepMind 发布 Gemini 3.8 Live 与 3.8 Live Extended Thinking

    Google DeepMind 发布 Gemini 3.8 Live 和 Gemini 3.8 Live Extended Thinking 两款实时语音对话模型。

    推荐理由:两款实时语音对话模型同时给出语音质量榜单分数和逐步开放的入口,可用于判断语音智能体的可用边界。

已经到底了