阿里开放 Qwen3.8 旗舰模型权重,参数达 2.4 万亿
阿里正式开放 Qwen3.8-2.4T-A95B 权重,为代码与长程智能体提供可独立部署的超大规模基础模型。
正式开放权重
阿里 Qwen 团队发布 Qwen3.8-2.4T-A95B 的模型权重和模型卡,让外部机构可以下载并自行运行商业服务 Qwen3.8-Max 所基于的基础模型。该模型采用混合专家架构,总参数量达 2.4 万亿,但每个 token 仅激活约 950 亿参数,目标是在扩大模型总容量的同时,避免每次推理都调用全部参数。
公开版本原生支持 262,144 token 上下文,重点面向编程、复杂工具调用和长时间运行的智能体工作流。Unsloth 还推出极限一比特量化版本,把原本约 4.9TB 的模型压缩至约 397GB。不过,即使是压缩版也远超普通消费级设备的承载能力,说明“权重可下载”并不等于多数开发者都能在本地轻松部署。
部分推理服务商另行宣布了 Qwen3.8 品牌模型的首日可用性,但这些公告必须按具体模型分别判断:专有服务 Qwen3.8-Max 已经上线,并不能单独证明可下载的 Qwen3.8-2.4T-A95B 权重也已由同一平台提供托管推理。
需要注意的是,开放权重版本并不完全等同于阿里的商业服务 Qwen3.8-Max。模型文档显示,托管版以该开放模型为基础,但还提供视觉输入、非思考模式、内置工具以及默认 100 万 token 上下文。因此,需要数据主权或深度定制的用户获得了核心文本模型,但不会自动拥有云端产品的全部能力。
为何重要
这是迄今规模最大的可公开下载语言模型之一。更关键的是,它为云服务商、国家级 AI 项目和大型企业提供了一个面向智能体软件开发的闭源 API 替代方案。高昂的硬件门槛会限制直接部署,但开放权重将成为量化、微调和推理系统研究的共同底座,也会迫使西方前沿实验室用更难复制的能力来证明闭源模式的价值。