⚡ 猫叔的AI资讯雷达
模型Agent产业

Anthropic发布Claude Sonnet 5.5:更快且更省成本

Anthropic称Sonnet 5.5速度提升超过30%,单任务成本最高下降30%,代理式编码能力大幅增强。

更强的中端模型

Anthropic发布Claude Sonnet 5.5,将其定位在能力更强的Opus 5.5与面向高并发场景的Haiku 5.5之间。新模型沿用Sonnet 5每百万输入Token 2美元、每百万输出Token 10美元的标价,但Anthropic称,由于完成相同任务所需Token更少,整体速度提升超过30%,单任务成本最高可降低30%。

最显著的变化出现在Terminal-Bench 4.0代理式编码评测中。Anthropic公布的结果显示,Sonnet 5.5得分70.6%,Sonnet 5为10.3%。公司还称,新模型在真实工作评测中已接近Opus 5.5,并改善了长周期任务和基于图像的推理能力。

发布即进入开发者工作流

Sonnet 5.5已通过Anthropic平台提供,并迅速进入Claude Code、Devin、Cursor、GitHub Copilot、AWS等开发工具和云服务。这样的分发方式让模型直接进入最看重速度、稳定性和单任务成本的工作场景。

Anthropic称,Sonnet 5.5上线时配备了接近高能力模型的网络安全防护和回退机制。这些防护主要针对少数高风险请求,普通软件开发和大多数生命科学工作不受影响。

为什么重要

Sonnet 5.5说明模型竞争正在转向单位时间和单位成本能完成多少有效工作。若一个模型能接近旗舰系统,同时速度更快、Token消耗更少,开发者的默认模型选择可能随之改变。尚未确定的是,评测中的优势能否延续到生产环境,因为工具稳定性、上下文管理和错误恢复往往比榜单分数更能决定最终结果。

猫叔判断: Terminal-Bench从10.3%跃升至70.6%很亮眼,但真正的买家会看这一步能否离开Anthropic测试框架后仍然成立。

信源