⚡ 猫叔的AI资讯雷达
模型Agent产业

OpenAI上线GPT-6.1 Sol超高速模式

OpenAI为GPT-6.1 Sol推出Ultrafast模式,覆盖API、Codex和ChatGPT Work,以更高价格换取更低响应延迟。

OpenAI开始为GPT-6.1 Sol推出Ultrafast模式,覆盖API、Codex和ChatGPT Work。公司称,该模式的生成速度最高可达到标准Sol配置的8倍,同时面向需要高强度推理的工作,保持接近的智能水平。

价格与覆盖范围

API价格为每百万输入token 12美元、每百万输出token 60美元。OpenAI将其定位于对延迟敏感的场景,例如处理线上故障、让智能体操作软件界面,以及等待时间会直接影响体验的互动应用。

在Codex和ChatGPT Work中,Ultrafast目前面向Pro 500、符合条件的按用量计费企业账户和采用额度制的教育账户开放;企业管理员还需要手动启用。OpenAI表示,该功能覆盖所有支持的地区,并支持美国和欧盟的数据驻留。GPT-6.1 Sol Fast与GPT-6 Luna Fast也新增了欧盟数据驻留支持。

这次公告本质上是部署方式和价格层级的变化,而不是一次全新模型发布。它延续了OpenAI为同一模型家族提供不同延迟档位的策略。对智能体来说,更快的响应可以缩短工具调用之间的等待时间;但最终经济性仍取决于更高的输出价格,能否被更短的会话时间或更高的任务完成率抵消。

为什么重要

推理速度正在从基础设施指标变成产品能力。对编程智能体和计算机操作系统来说,每一次停顿都可能打断工作流,也可能迫使开发者减少推理步骤。OpenAI现在实际上是在把“响应快”直接纳入模型能力的销售范围。

真正尚未验证的是任务层面的价值。速度提高8倍,并不意味着生产率也提高8倍;对于长时间运行的智能体,输出价格尤其关键。企业最终需要比较的是延迟、工具调用成功率和每项完成任务的总成本,而不是单看生成速度。

信源