⚡ 猫叔的AI资讯雷达
模型产业

阿里发布 2.4 万亿参数 Qwen3.8-Max,API 先行

阿里新旗舰 Qwen3.8-Max 为 2.4 万亿参数 MoE 模型,主打长周期智能体任务,官方称下周开放权重。

Max 级模型,价格直接压下来

阿里通义千问团队 8 月 3 日发布 Qwen3.8-Max,称其为 Qwen 家族至今最强的模型。官方给出的规模是 2.4 万亿参数的混合专家架构,支持文本、图像与视频输入,上下文窗口 100 万 token——输入最高 991K,开启推理模式后降至 983K,输出最高 131K。阿里自身材料未披露激活参数量,The Decoder 报道单次查询约激活 950 亿参数,若准确,实际推理成本会远低于总参数量给人的印象。

海外 API 定价为每百万 token 输入 2 美元、输出 6 美元,缓存命中的输入仅 0.25 美元;国内定价为每百万 token 输入 12 元、输出 36 元,隐式缓存命中 1.5 元。模型已在 QwenCloud 上线,同时兼容 OpenAI Chat Completions 与 Anthropic 两套接口协议。

卖点押在「跑得久」

这次发布的重心不是单轮跑分,而是多日自主作业。官方案例包括:模型用 16 天独立开发一个命令行工具,累计 265 次提交、127 个 PR;约 5 天复现并改进一篇论文结果,期间跑了 33 个 GPU 训练任务;在一项多模态竞赛中拿到 0.853 的成绩,排名超过 526 支人类队伍中的 458 支。跑分方面,Terminal-Bench 2.1 得 86.6,低于 GPT-5.6 Sol 的 88.8、高于 Anthropic 的 84.6;PaperBench 官方报 93 分。

第三方榜单反应很快。LMArena 显示 Qwen3.8-Max 文本榜第五(1496 分),其中医疗健康职业分项排名第一;视觉榜第二(1305 分),仅落后 Claude Fable 5(High)13 分;前端代码竞技场的性价比帕累托前沿也被这次发布改写。

为什么重要

Max 一直是 Qwen 家族里唯一不开源的那一档,所以真正值得记的承诺是:阿里表示下周将在 Hugging Face 与魔搭放出权重,并同步推出面向本地部署的 Qwen3.8-27B 小尺寸版本。目前权重尚未公开,就当下而言这仍只是一次 API 发布。但如果按官方说法落地,一个价格仅为西方旗舰约三分之一、身后还跟着可下载版本的前沿模型,将直接冲击闭源阵营给智能体类负载的定价逻辑。

信源