适用读者:通过 API 或 ChatGPT Work 调用 GPT-5.6 的开发者、FinOps 负责人,以及正在 Kimi K3、DeepSeek 与 OpenAI 之间做选型决策的技术团队。📌 2026 年 7 月 30 日,OpenAI 宣布下调 Luna(-80%)与 Terra(-20%)的 API 价格,旗舰 Sol 维持原价但新增贵一倍、快 2.5 倍的 Fast 模式——距 GPT-5.6 系列发布仅 3 周。你将获得:完整时间线、三档调价对照表、Sol 自写 GPU 代码降本叙事拆解、竞品横向比价、争议点标注,以及六步 Agent 路由 Runbook。结构:痛点 → 时间线 → 数据表 → 深度拆解 → 竞品对比 → 争议 → 背景 → Runbook → 收束转化。首发规格回顾见GPT-5.6 发布解析。
TL;DR — 30 秒结论
7 月 30 日调价公告一出,技术圈普遍卡在以下六个决策盲区——不是不知道「降价了」,而是无法把三档模型的差异化策略翻译成可执行的 API 路由方案:
下文用官方公告、媒体报道与第三方比价数据,把上述六个盲区逐一填平。
结论先行:这不是孤立促销,而是「发布 → 披露降本手段 → 降价」三步走的连续剧本,节奏之快在 OpenAI 历史上罕见,说明价格竞争已从「友好竞对」升级为「必须立刻回应」的紧迫问题。Kimi K3 开源细节见Kimi K3 全面开源解读。
| 模型 | 调整前(输入/输出,每百万 Token) | 调整后(输入/输出) | 降幅 |
|---|---|---|---|
| GPT-5.6 Luna | $1.00 / $6.00 | $0.20 / $1.20 | -80% |
| GPT-5.6 Terra | $2.50 / $15.00 | $2.00 / $12.00 | -20% |
| GPT-5.6 Sol(标准模式) | $5.00 / $30.00 | $5.00 / $30.00(不变) | 0% |
| GPT-5.6 Sol(新增 Fast 模式) | 无此模式 | $10.00 / $60.00 | 标准价 2 倍(速度最高提升 2.5 倍) |
备注:Sol Fast 模式替代此前的 Priority Processing,智力水平与标准模式一致,仅速度和价格不同;ChatGPT Work、Codex 的订阅价格未变,但 Luna/Terra 的额度消耗随降价同步减少。以上数据来自 OpenAI 官方博客(厂商自报,已与多家媒体报道交叉核实)。
分析:降幅最大的恰恰是最便宜的 Luna——它定位「可调用工具、执行多步任务」的高频 Agent 工作负载,降价直接降低企业长期跑 Agent 工作流的门槛;Terra 温和降价保住中间档位利润;Sol 纹丝不动、反而多一个更贵的 Fast 模式,说明 OpenAI 在旗舰上仍坚持「能力溢价」,用速度而非降价创造新的付费维度。
根据 OpenAI 技术博客,GPT-5.6 Sol 在 Codex 环境中被用来优化自身的推理基础设施:改写并优化生产环境 GPU 内核代码(使用 OpenAI 自研的开源 GPU 编程语言 Triton 和 Gluon)、重新设计投机解码所用的「草稿模型」、优化 KV 缓存管理和 GPU 任务调度。官方成果:端到端服务成本下降 20%,Token 生成效率提升超过 15%;并用自研开源工具 FpSan(浮点数验证器)校验 AI 改写代码的正确性。
技术风险点:AI 改写自己运行的底层代码,会不会引入难以察觉的数值错误?OpenAI 用 FpSan 兜底,说明团队本身也意识到「模型改代码」不能只靠信任。从公开信息看,这是目前已知第一例「生产级前沿模型自主改写并上线自身服务栈代码,且改动直接体现在对外定价上」的案例,具备真实工程含金量;但验证过程与收益拆解均由 OpenAI 单方面披露,「20% 成本下降」目前仍属厂商自报。
Luna 大幅降价抢占价格敏感型、高并发 Agent 场景;Terra 小幅降价维持「够用不贵」的主力档位;Sol 维持高价并新增 Fast 模式,把「速度」变成独立付费维度。这是「低端打价格战、高端做溢价」的组合拳,与 Moonshot、DeepSeek「性价比优先」的单一打法明显不同。
7 月 16 日 Kimi K3 发布即冲上市场热议;越来越多企业客户对大额 AI 支出变得谨慎;降价、披露降本技术细节、上线 Fast 模式三件事挤在一周内发生,更像针对性极强的公关与产品组合动作,而非单纯的成本下降后自然让利。DeepSeek 定价背景见DeepSeek V4 GA 定价与迁移指南。
| 模型 | 厂商 | 输入($/M Token) | 输出($/M Token) | 备注 |
|---|---|---|---|---|
| GPT-5.6 Luna | OpenAI | $0.20 | $1.20 | 降价后 |
| GPT-5.6 Terra | OpenAI | $2.00 | $12.00 | 降价后 |
| GPT-5.6 Sol | OpenAI | $5.00 | $30.00 | 未变 |
| Kimi K3 | 月之暗面 | $3.00(缓存 $0.30) | $15.00 | 开源权重,2.8T MoE |
| DeepSeek V4 Pro | DeepSeek | $0.435(缓存 $0.0036) | $0.87 | 2026 年 5 月永久降价 75% |
| DeepSeek V4 Flash | DeepSeek | $0.14 | $0.28 | 轻量档 |
| Claude Sonnet 5 | Anthropic | $3.00(促销 $2.00 至 8/31) | $15.00(促销 $10.00) | 与 Kimi K3 标准价持平 |
| Gemini 3.5 Flash-Lite | 约合计 $2.80/M | 轻量档 | ||
| MAI-Code-1-Flash | Microsoft | $0.75 | $4.50 | 仅限 GitHub Copilot,无独立 API |
数据来自各厂商官方定价页及 Model Price Watch、BenchLM 等第三方比价站点,部分为厂商自报促销价,实际计费请以各平台当前公示价格为准。
分析:降价后 Luna 合计 $1.40/M 已低于 Gemini 3.5 Flash-Lite,正式挤进小模型价格竞争第一梯队;但 DeepSeek V4 系列和 Kimi K3 的缓存命中价仍明显更低——这次降价更准确的定位是「缩小与低价竞品的差距,而不是反超」。值得注意的是,Artificial Analysis 按「完成同等质量任务的实际花费」测算,Kimi K3 与 GPT-5.6 Sol 的实际成本已相当接近(约 $0.94 vs $1.04/任务),说明单纯比 Token 报价容易忽略模型「啰嗦程度」和任务完成质量的差异。
这次调价发生在一个更大的行业叙事里:DeepSeek(5 月起 V4 Pro 永久降价 75%)、Moonshot(Kimi K3 开源 + 低价冲击)持续把「性价比」作为主武器;微软正大力推广 MAI 系列(如 MAI-Code-1-Flash $0.75/$4.50,仅限 Copilot),试图证明不依赖 OpenAI 也能做好高频任务。价格战如果持续,可能反过来冲击前沿实验室的营收增长——降价能换市场份额,但也在压缩利润空间。
from openai import OpenAI
client = OpenAI() # 使用 OPENAI_API_KEY 环境变量
# Luna:高频 Agent / 工具调用(降价后 $0.20/$1.20 per 1M tokens)
response = client.chat.completions.create(
model="gpt-5.6-luna",
messages=[{"role": "user", "content": "Summarize this log file and extract errors."}],
max_tokens=2048,
)
# Sol Fast:仅对延迟敏感的生产任务启用($10/$60 per 1M tokens)
fast = client.chat.completions.create(
model="gpt-5.6-sol",
messages=[{"role": "user", "content": "Fix this failing unit test."}],
extra_body={"speed": "fast"}, # 以 OpenAI 官方文档当前参数名为准
)
在笔记本上临时切换 Luna / Terra / Sol 三档模型,合盖睡眠会中断 Agent 长会话,多模型 API Key 散落在各台开发机难以统一轮换,降价窗口期的路由实验也容易因网络抖动变成生产事故——这些问题与 OpenAI 定价本身无关,却直接决定你能否把 Luna 80% 降幅转化为稳定的 Agent 产出。
若在本地环境硬扛多档模型路由与 7×24 Agent 工作流,上述隐性成本会随调用量线性放大。对于更稳定、更适合 AI Agent 自动化的生产环境,MACCOME 的 Mac 云主机通常是更优解——真实 macOS、SSH 交接、环境隔离,让 OpenClaw / Cursor Agent Gateway 在专用实例上稳定运行 Luna 默认路由与 Sol fallback 链。方案与定价见Mac mini 云租用价格。
数据来源:OpenAI 官方博客《Advancing the price-performance frontier with GPT-5.6》《How GPT-5.6 fuses frontier intelligence with frontier efficiency》(2026 年 7 月 29–30 日);VentureBeat、The Decoder、CNBC/Reuters/Axios 等英文媒体报道;IT 之家、36 氪、华尔街见闻、中央社等中文媒体报道;The New Stack、Hardware Busters(METR 评测、Reddit 社区反应);Model Price Watch、BenchLM.ai、Artificial Analysis 定价与评测数据。发布前请务必核实最新价格与政策。
常见问题
GPT-5.6 Luna 降价后具体多少钱?
降价后 Luna 的 API 价格为每百万 Token 输入 $0.20、输出 $1.20,相比原价的 $1.00/$6.00 下降 80%,是 GPT-5.6 系列里降幅最大的一档。
为什么 Sol 没有降价,反而多了更贵的 Fast 模式?
OpenAI 把 Sol 定位为「能力溢价」的旗舰产品,选择用速度作为新的付费维度:Fast 模式价格为标准模式的 2 倍($10.00/$60.00),速度最高提升 2.5 倍,模型能力本身不变,替代此前的 Priority Processing 服务。首发规格对比见GPT-5.6 发布解析。
OpenAI 说降价是因为 AI 自己优化了 GPU 代码,这个说法可信吗?
这是 OpenAI 官方披露的信息,属于厂商自报数据,目前没有第三方机构复核具体的 20% 降本比例。外部技术媒体确认这是已知首例「生产级前沿模型自主改写并上线自身服务栈代码」的公开案例,工程细节(Triton/Gluon 内核、FpSan 验证)具备一定可信度,但降本幅度本身建议保持谨慎。
降价对国内开发者有什么影响?
对通过官方 API 或第三方中转访问 GPT-5.6 的国内开发者而言,Luna、Terra 的调用成本明显下降,尤其利好需要跑批量任务或 Agent 工作流的场景;但由于国内合规访问方式、汇率和平台加成不同,实际到手价格仍需以具体渠道公示为准。
GPT-5.6 现在还比 Kimi K3、DeepSeek V4 Pro 贵吗?
按单纯 Token 报价,Luna 已低于多数国际竞品,但仍高于 DeepSeek V4 系列;Sol 依然明显高于 Kimi K3 和 DeepSeek V4 Pro。不过独立评测显示,若按「完成同等任务的实际花费」计算,Sol 与 Kimi K3 的实际成本差距会比单纯 Token 单价的差距小很多。在专用节点上跑多模型路由,可查看MACCOME Mac 云租用方案。