SpaceXAI 发布 Grok 4.6,主攻长程智能体任务
Grok 4.6 以 50 万 token 上下文、原生工具调用和更低定价切入编程及长时间运行的智能体工作流。
围绕长时间任务优化
SpaceXAI 发布新一代前沿模型 Grok 4.6,重点面向编程、知识工作以及需要连续多轮调用工具的智能体。模型已通过官方 API 开放,并在发布当天进入 Devin、Poe 等第三方产品,因此其覆盖范围从一开始就不局限于 SpaceXAI 自有应用。
Grok 4.6 支持 50 万 token 上下文,并原生提供函数调用、代码执行、网页搜索和 X 搜索。SpaceXAI 还重点强调上下文压缩与可预测的提示缓存,试图控制智能体反复读取代码库、执行程序和修改计划时不断上升的成本与不稳定性。标准 API 定价为每百万输入 token 2 美元、每百万输出 token 6 美元,另有价格更高的高速服务档位。
Artificial Analysis 的初步独立测试中,Grok 4.6 在 Intelligence Index 综合指标上获得 61 分,与 OpenAI GPT-5.6 Sol 处于相近水平,而测试工作负载的成本更低。在衡量智能体知识工作的 AA-Briefcase 中,它相较 Grok 4.5 也有明显提升。不过,基准成绩不能直接等同于真实生产效果:智能体框架、上下文长度、缓存命中率和重试次数都会显著改变最终性能与总成本。
为何重要
这次发布反映出前沿模型竞争重心正在变化。厂商比拼的不再只是一次回答是否更聪明,而是模型能否在持续数小时的工作流中保持可靠且经济。SpaceXAI 希望借助有竞争力的评测表现、内置工具和进取定价,成为其他公司智能体产品中的默认“执行者”。多家平台首日接入也说明,未来模型分发的关键入口越来越可能是编程智能体和工作流平台,而不只是面向消费者的聊天应用。