谷歌发布 Gemini 3.8 Live 实时语音模型
Gemini 3.8 Live 面向生产级语音代理,主打更低延迟、视觉理解、97种语言切换与更低音频成本。
它同时改变了语音代理的能力边界与单位成本,是本期最具全球平台影响力的模型发布。
当天发布的全部深度简报与一句话快讯。
Gemini 3.8 Live 面向生产级语音代理,主打更低延迟、视觉理解、97种语言切换与更低音频成本。
它同时改变了语音代理的能力边界与单位成本,是本期最具全球平台影响力的模型发布。
阶跃星辰推出覆盖实时语音、识别、合成、音频生成和音乐创作的五模型家族,并同步接入开放平台。
北京中关村学院团队公开ZGCM-1的权重、数据配方、代码、检查点和训练日志,展示代理群协作训练大模型的完整流程。
Meta与华盛顿大学研究者发现,字节级蒸馏模型起步较慢,却可能在更大训练规模下取得更高能力上限并降低教师分布存储压力。
AI评测论坛发布AEF-1标准,要求第三方披露模型访问权限、利益冲突、分析自主性、方法透明度与法律安全港。