Meta发布Muse Spark 1.3,主攻编程智能体
Muse Spark 1.3强化长流程编程和智能体任务,但开放权重与最高推理档位均未在发布当天提供。
面向智能体任务的模型升级
Meta 通过 Muse Code 和 Meta Model API 发布 Muse Spark 1.3,重点提升持续编程、工具调用以及真实场景中的智能体任务能力。开发者目前可以调用托管模型,但这还不是一次开放权重发布:Meta 只表示可下载权重将在之后推出,没有给出明确时间。
此次上线还把现有推理档位与计算量最高的“max”模式分开。Meta 称,max 模式需要完成额外安全测试后才会开放。这一区别不能忽略,因为发布当天部分最亮眼的第三方成绩来自尚未上线的 max 版本,并不代表开发者现在能够直接使用的配置。
Artificial Analysis 的测试显示,Muse Spark 1.3 max 在 Tau3-Bench Banking 上取得52%,是该机构在这项银行业务智能体评测中记录的最高成绩;已经开放的 xhigh 档位得分为47%。该机构同时认为,xhigh 在相近能力水平上具有较好的成本效率。Meta 保持每百万输入 token 1.25美元、每百万输出 token 4.25美元的价格不变,而本轮提升主要集中在智能体评测,并非所有能力类别都同步大幅增长。
发布范围限制了榜单含金量
Muse Spark 1.3让 Meta 在编程智能体市场同时拥有自家工具框架和模型 API,也保留了通过开放权重发展本地生态的可能。这种分阶段发布可以先推动云端采用,再决定何时释放更敏感或资源需求更高的版本。
它最终有多重要,仍取决于 Meta 实际交付什么。托管接口已经提供了可用的新选择,但开发者尚不能审查、微调或自主部署权重;同样,未开放的 max 成绩不应被当作现有产品能力。下一项真正关键的节点,是承诺中的权重能否保持接近托管版的水平,并采用足以支持商业部署的许可条款。