⚡ 猫叔的AI资讯雷达
产业模型

OpenAI 下调 GPT-5.6 定价:Luna 降 80%、Terra 降 20%

OpenAI 大幅下调 GPT-5.6 系列 API 价格,Luna 输入价降至每百万 token 0.2 美元,并为 Sol 新增付费高速模式。

OpenAI 周四宣布即时下调 GPT-5.6 系列的 API 价格,入门档 Luna 降价 80%,中间档 Terra 降价 20%。

具体变化

Luna 的输入价格降至每百万 token 0.2 美元、输出 1.2 美元,此前分别约为 1 美元和 6 美元;Terra 调整为输入 2 美元、输出 12 美元。同时,OpenAI 为 GPT-5.6 Sol 在 API 中新增 Fast 处理模式,吞吐最高可达标准模式的 2.5 倍,价格为标准档的两倍——把"低延迟"单独拆成一个付费档位,在 OpenAI 的定价史上并不常见。

官方将降价归因于模型、推理栈和智能体 harness 三个层面的效率优化:GPT-5.6 Sol 被用来优化 GPU 底层软件,使自身部署成本下降约 20%;投机解码等改进则让 token 生成吞吐提升超过 15%。OpenAI 用任务成本来描述综合效果:一年前在同类模型上花费约 1 美元的任务,如今在 Luna 上约合 6 美分,且完成速度明显更快。

与降价同步,ChatGPT 应用和 Codex CLI 中的自动代码审查从 GPT-5.4 切换到 GPT-5.6 Luna,OpenAI 称模型更换叠加新价格将大幅降低自动审查开销。Cognition 当天即更新 FrontierCode 1.1 榜单,按新成本重新计算后把 GPT-5.6 系列放在了性价比帕累托前沿上;Arena 榜单同日也完成重新定价。

为何重要

推理定价已经成为中美实验室最直接的竞争战场——智谱、月之暗面、DeepSeek 等开源权重模型的调用成本长期比西方 API 低一个数量级。一次针对通用档位的 80% 降价,等于正面压缩这道价差,也重写了智能体产品"自建还是采购"的账本。对于 token 消耗随任务时长而非用户数增长的长程智能体来说,这更像是单位经济模型的结构性变化,而不是一次常规促销。

信源