跳到正文
9月25日周五
  1. Google DeepMind71

    Google DeepMind 发布 Gemini 3.8 Live with Live Avatar

    Google DeepMind 发布 Gemini 3.8 Live with Live Avatar,在 Gemini 3.8 Live 基础上为原生实时对话模型加入近实时视频生成,实现带唇形同步、表情和自然轮次切换的动态视觉形象。

    推荐理由:官方给出 Live Avatar 的实时音视频能力、97 种语言切换与企业定制入口,可据此判断多模态对话的产品化边界。

9月23日周三
  1. Google DeepMind74

    Google DeepMind 发布 Gemini 3.8 Flash TTS 与 Flash-Lite TTS

    Google DeepMind 推出 Gemini 3.8 Flash TTS 和 Gemini 3.8 Flash-Lite TTS 两款语音生成模型,前者面向角色设计与逐行表演指导,后者面向高并发配音与语音智能体。

    推荐理由:官方给出两款 TTS 模型的语音定制能力、基准排名与开放渠道,可据此判断语音生成在配音与有声内容上的可用边界。

9月16日周三