阿里升级Qwen3.8-Max,登顶网页开发竞技场
阿里发布Qwen3.8-Max-0902,在保留百万上下文与多模态能力的同时,登上Code Arena网页开发榜首。
旗舰模型进一步强化
阿里通义千问发布Qwen3.8-Max-0902,这是其2.4万亿参数旗舰模型的新版API快照。模型继续提供100万词元上下文,并原生接收文本、图像和视频输入,重点提升编程、科研以及需要长期连续执行的智能体任务。
此次更新上线的是API模型,并非新的开放权重检查点。QwenCloud显示,其最大输入和输出分别约为99.1万和13.1万词元,并支持函数调用、结构化输出以及网页搜索、内容提取、代码执行和图像检索等内置工具。标准价格维持每百万输入词元2美元、每百万输出词元6美元;显式缓存读取价格为每百万词元0.17美元。
编程榜单成为最大看点
在独立评测平台Code Arena的WebDev榜单上,Qwen3.8-Max-0902以1691分排名第一,比上一版Qwen3.8-Max高22分,领先Claude Opus 5 Max三分、领先Kimi K3 Max十七分。按每百万词元约5美元的综合价格计算,它同时进入该榜单的成本—性能前沿。
该榜单通过对生成的网页开发成果进行成对比较,比孤立问答测试更贴近智能体编程。不过,这一结果尚不足以证明Qwen在软件维护、终端操作或生产环境可靠性上全面领先。阿里公布的多项智能体编程成绩同样显示明显进步,但仍有待更广泛的独立复现。
为何重要
这次发布增强的是中国厂商在高端托管模型市场的竞争力,而非开放权重生态。领先的编程成绩、多模态输入、超长上下文和积极定价相结合,为软件智能体开发者增加了一个有分量的供应商选择。更值得持续观察的是,这22分的提升能否延伸到真实代码库中的长时间工作;在那里,出错后的恢复能力和工具调用稳定性,通常比榜首的微小分差更关键。