⚡ 猫叔的AI资讯雷达
模型Agent产业

xAI发布Grok 4.7,主攻长时编码与知识工作

Grok 4.7面向长时间编码和专业任务推出,输入每百万Token起价2美元,重点押注持续推理能力。

更大的模型,更低的价格

xAI发布Grok 4.7,称其为目前最强的编码与知识工作模型。新模型采用比Grok 4.6更大的基础模型,并延长了强化学习训练,重点优化需要持续数小时完成的复杂任务。

Grok 4.7已接入Grok API、Grok Build、Cursor、第三方编码智能体、模型路由平台及云服务。xAI公布的价格为:输入每百万Token 2美元、输出每百万Token 6美元,适用于低于20万Token的提示。API版本提供50万Token上下文窗口,支持文本和图像输入,输出仍为文本。

长任务进步明显,但并非全面领先

xAI称,Grok 4.7在多项测试中超过前代。CursorBench 4.0得分从40.4%升至46.3%,Terminal-Bench 4.0则从20.3%提高到38%。在法律、临床推理和电气工程测试中,新模型也有所提升;在高强度设置下,DeepSWE得分达到71%。

但它并未在所有项目中领先。xAI自己的对比表显示,Grok 4.7在部分软件工程和终端任务上仍落后于Anthropic的Fable 5.1,同时与其他前沿模型保持竞争力。公司还公布了新的安全防护栈,称模型在高风险网络安全提示上的误通过率更低,并在生物安全测试中表现更强。

为什么重要

Grok 4.7的意义不只是榜单排名,而是价格与分发方式的组合。一个面向数小时复杂工作的前沿模型,以较低价格进入编码工具和智能体平台,可能推动更多持续运行的工作流落地。最终能否形成真正优势,仍取决于独立机构对其基准成绩和实际工具使用能力的复测。

猫叔判断

Terminal-Bench达到38%是关键数字:xAI正在证明它能持续调用工具,但折扣是否真的划算,还要看独立智能体实测。

信源