⚡ AI专注速报
模型开源

Poolside 开源 Laguna S 2.1,小激活 MoE 冲进编码模型第一梯队

Poolside 发布 118B 参数、8B 激活的开源编码模型 Laguna S 2.1,SWE-Bench Multilingual 达 78.5%,OpenRouter 定价仅每百万 token 一两毛美元。

Poolside 于 7 月 21 日发布开源智能体编码模型 Laguna S 2.1,官方称其为"同重量级中遥遥领先的最强编码模型"。这是一个 1180 亿参数的 MoE 模型,每 token 仅激活 80 亿参数,支持 100 万 token 上下文,从开始训练到发布只用了不到九周。

激活量小,分数不小

跑分撑得起这个定位:SWE-Bench Multilingual 78.5%,SWE-Bench Pro 59.4%,Terminal-Bench 2.1 得分 70.2%——在该榜单排第 11 名,而排在它前面的模型大多体量远超于它——DeepSWE v1.1 则拿到 40.4%。Poolside 强调的不是堆参数,而是长任务行为:面对难题的持续性、自我验证、从死胡同里退出来重试——这些特质对自主编码智能体比单次答题准确率更关键。

发行策略相当激进:权重以 Linux 基金会 OpenMDW-1.1 许可证登陆 Hugging Face,提供 BF16、FP8、INT4、NVFP4 四种格式;已上线 Baseten、Vercel AI Gateway 和 OpenRouter——后者定价每百万输入 token 0.10 美元、输出 0.20 美元,只有前沿模型 API 的零头——并接入 Cline 等编码智能体。chat.poolside.ai 还提供免登录的免费网页版。

这也是 Poolside 三个月内的第三次发布:4 月的 M.1 与 XS.2,7 月初的 XS 2.1,节奏拉满。

为什么重要

开源编码模型的重心正持续向"小激活 MoE"倾斜——规模化跑起来便宜,才是硬道理。Laguna S 2.1 在智能体基准上逼近前沿模型,价格却低一个数量级,恰好踩中当下兴起的多智能体集群工作流的成本痛点。对长期活在巨头阴影下的 Poolside,这是一次立信之作;对整个市场,这是"够用的编码智能正在快速商品化"的又一实锤。

信源