適用讀者:透過 API 或 ChatGPT Work 調用 GPT-5.6 的開發者、FinOps 負責人,以及正在 Kimi K3、DeepSeek 與 OpenAI 之間做選型決策的技術團隊。2026 年 7 月 30 日,OpenAI 宣布下調 Luna(-80%)與 Terra(-20%)的 API 價格,旗艦 Sol 維持原價但新增貴一倍、快 2.5 倍的 Fast 模式——距 GPT-5.6 系列發布僅 3 週。你將獲得:完整時間線、三檔調價對照表、Sol 自寫 GPU 程式碼降本敘事拆解、競品橫向比價、爭議點標註,以及六步 Agent 路由 Runbook。結構:痛點 → 時間線 → 數據表 → 深度拆解 → 競品對比 → 爭議 → 背景 → Runbook → 收束轉化。首發規格回顧見GPT-5.6 發布解析。
TL;DR — 30 秒結論
7 月 30 日調價公告一出,技術圈普遍卡在以下六個決策盲區——不是不知道「降價了」,而是無法把三檔模型的差異化策略翻譯成可執行的 API 路由方案:
下文用官方公告、媒體報導與第三方比價數據,把上述六個盲區逐一填平。
結論先行:這不是孤立促銷,而是「發布 → 披露降本手段 → 降價」三步走的連續劇本,節奏之快在 OpenAI 歷史上罕見,說明價格競爭已從「友好競對」升級為「必須立刻回應」的緊迫問題。Kimi K3 開源細節見Kimi K3 全面開源解讀。
| 模型 | 調整前(輸入/輸出,每百萬 Token) | 調整後(輸入/輸出) | 降幅 |
|---|---|---|---|
| GPT-5.6 Luna | $1.00 / $6.00 | $0.20 / $1.20 | -80% |
| GPT-5.6 Terra | $2.50 / $15.00 | $2.00 / $12.00 | -20% |
| GPT-5.6 Sol(標準模式) | $5.00 / $30.00 | $5.00 / $30.00(不變) | 0% |
| GPT-5.6 Sol(新增 Fast 模式) | 無此模式 | $10.00 / $60.00 | 標準價 2 倍(速度最高提升 2.5 倍) |
備註:Sol Fast 模式替代此前的 Priority Processing,智力水準與標準模式一致,僅速度和價格不同;ChatGPT Work、Codex 的訂閱價格未變,但 Luna/Terra 的額度消耗隨降價同步減少。以上數據來自 OpenAI 官方部落格(廠商自報,已與多家媒體報導交叉核實)。
分析:降幅最大的恰恰是最便宜的 Luna——它定位「可調用工具、執行多步任務」的高頻 Agent 工作負載,降價直接降低企業長期跑 Agent 工作流的門檻;Terra 溫和降價保住中間檔位利潤;Sol 紋絲不動、反而多一個更貴的 Fast 模式,說明 OpenAI 在旗艦上仍堅持「能力溢價」,用速度而非降價創造新的付費維度。
根據 OpenAI 技術部落格,GPT-5.6 Sol 在 Codex 環境中被用來優化自身的推理基礎設施:改寫並優化生產環境 GPU 內核程式碼(使用 OpenAI 自研的開源 GPU 程式設計語言 Triton 和 Gluon)、重新設計投機解碼所用的「草稿模型」、優化 KV 快取管理和 GPU 任務調度。官方成果:端到端服務成本下降 20%,Token 生成效率提升超過 15%;並用自研開源工具 FpSan(浮點數驗證器)校驗 AI 改寫程式碼的正確性。
技術風險點:AI 改寫自己運行的底層程式碼,會不會引入難以察覺的數值錯誤?OpenAI 用 FpSan 兜底,說明團隊本身也意識到「模型改程式碼」不能只靠信任。從公開資訊看,這是目前已知第一例「生產級前沿模型自主改寫並上線自身服務棧程式碼,且改動直接體現在對外定價上」的案例,具備真實工程含金量;但驗證過程與收益拆解均由 OpenAI 單方面披露,「20% 成本下降」目前仍屬廠商自報。
Luna 大幅降價搶占價格敏感型、高並發 Agent 場景;Terra 小幅降價維持「夠用不貴」的主力檔位;Sol 維持高價並新增 Fast 模式,把「速度」變成獨立付費維度。這是「低端打價格戰、高端做溢價」的組合拳,與 Moonshot、DeepSeek「性價比優先」的單一打法明顯不同。
7 月 16 日 Kimi K3 發布即衝上市場熱議;越來越多企業客戶對大額 AI 支出變得謹慎;降價、披露降本技術細節、上線 Fast 模式三件事擠在一週內發生,更像針對性極強的公關與產品組合動作,而非單純的成本下降後自然讓利。DeepSeek 定價背景見DeepSeek V4 GA 定價與遷移指南。
| 模型 | 廠商 | 輸入($/M Token) | 輸出($/M Token) | 備註 |
|---|---|---|---|---|
| GPT-5.6 Luna | OpenAI | $0.20 | $1.20 | 降價後 |
| GPT-5.6 Terra | OpenAI | $2.00 | $12.00 | 降價後 |
| GPT-5.6 Sol | OpenAI | $5.00 | $30.00 | 未變 |
| Kimi K3 | 月之暗面 | $3.00(快取 $0.30) | $15.00 | 開源權重,2.8T MoE |
| DeepSeek V4 Pro | DeepSeek | $0.435(快取 $0.0036) | $0.87 | 2026 年 5 月永久降價 75% |
| DeepSeek V4 Flash | DeepSeek | $0.14 | $0.28 | 輕量檔 |
| Claude Sonnet 5 | Anthropic | $3.00(促銷 $2.00 至 8/31) | $15.00(促銷 $10.00) | 與 Kimi K3 標準價持平 |
| Gemini 3.5 Flash-Lite | 約合計 $2.80/M | 輕量檔 | ||
| MAI-Code-1-Flash | Microsoft | $0.75 | $4.50 | 僅限 GitHub Copilot,無獨立 API |
數據來自各廠商官方定價頁及 Model Price Watch、BenchLM 等第三方比價站點,部分為廠商自報促銷價,實際計費請以各平台當前公示價格為準。
分析:降價後 Luna 合計 $1.40/M 已低於 Gemini 3.5 Flash-Lite,正式擠進小模型價格競爭第一梯隊;但 DeepSeek V4 系列和 Kimi K3 的快取命中價仍明顯更低——這次降價更準確的定位是「縮小與低價競品的差距,而不是反超」。值得注意的是,Artificial Analysis 按「完成同等品質任務的實際花費」測算,Kimi K3 與 GPT-5.6 Sol 的實際成本已相當接近(約 $0.94 vs $1.04/任務),說明單純比 Token 報價容易忽略模型「囉嗦程度」和任務完成品質的差異。
這次調價發生在一個更大的行業敘事裡:DeepSeek(5 月起 V4 Pro 永久降價 75%)、Moonshot(Kimi K3 開源 + 低價衝擊)持續把「性價比」作為主武器;微軟正大力推廣 MAI 系列(如 MAI-Code-1-Flash $0.75/$4.50,僅限 Copilot),試圖證明不依賴 OpenAI 也能做好高頻任務。價格戰如果持續,可能反過來衝擊前沿實驗室的營收成長——降價能換市場份額,但也在壓縮利潤空間。
from openai import OpenAI
client = OpenAI() # 使用 OPENAI_API_KEY 環境變數
# Luna:高頻 Agent / 工具調用(降價後 $0.20/$1.20 per 1M tokens)
response = client.chat.completions.create(
model="gpt-5.6-luna",
messages=[{"role": "user", "content": "Summarize this log file and extract errors."}],
max_tokens=2048,
)
# Sol Fast:僅對延遲敏感的生產任務啟用($10/$60 per 1M tokens)
fast = client.chat.completions.create(
model="gpt-5.6-sol",
messages=[{"role": "user", "content": "Fix this failing unit test."}],
extra_body={"speed": "fast"}, # 以 OpenAI 官方文件當前參數名為準
)
在筆電上臨時切換 Luna / Terra / Sol 三檔模型,合蓋睡眠會中斷 Agent 長會話,多模型 API Key 散落在各台開發機難以統一輪換,降價窗口期的路由實驗也容易因網路抖動變成生產事故——這些問題與 OpenAI 定價本身無關,卻直接決定你能否把 Luna 80% 降幅轉化為穩定的 Agent 產出。
若在本地環境硬扛多檔模型路由與 7×24 Agent 工作流,上述隱性成本會隨調用量線性放大。對於更穩定、更適合 AI Agent 自動化的生產環境,MACCOME 的 Mac 雲端主機通常是更優解——真實 macOS、SSH 交接、環境隔離,讓 OpenClaw / Cursor Agent Gateway 在專用實例上穩定運行 Luna 預設路由與 Sol fallback 鏈。方案與定價見Mac mini 雲端租用價格。
資料來源:OpenAI 官方部落格《Advancing the price-performance frontier with GPT-5.6》《How GPT-5.6 fuses frontier intelligence with frontier efficiency》(2026 年 7 月 29–30 日);VentureBeat、The Decoder、CNBC/Reuters/Axios 等英文媒體報導;IT 之家、36 氪、華爾街見聞、中央社等中文媒體報導;The New Stack、Hardware Busters(METR 評測、Reddit 社群反應);Model Price Watch、BenchLM.ai、Artificial Analysis 定價與評測數據。發布前請務必核實最新價格與政策。
常見問題
GPT-5.6 Luna 降價後具體多少錢?
降價後 Luna 的 API 價格為每百萬 Token 輸入 $0.20、輸出 $1.20,相比原價的 $1.00/$6.00 下降 80%,是 GPT-5.6 系列裡降幅最大的一檔。
為什麼 Sol 沒有降價,反而多了更貴的 Fast 模式?
OpenAI 把 Sol 定位為「能力溢價」的旗艦產品,選擇用速度作為新的付費維度:Fast 模式價格為標準模式的 2 倍($10.00/$60.00),速度最高提升 2.5 倍,模型能力本身不變,替代此前的 Priority Processing 服務。首發規格對比見GPT-5.6 發布解析。
OpenAI 說降價是因為 AI 自己優化了 GPU 程式碼,這個說法可信嗎?
這是 OpenAI 官方披露的資訊,屬於廠商自報數據,目前沒有第三方機構複核具體的 20% 降本比例。外部技術媒體確認這是已知首例「生產級前沿模型自主改寫並上線自身服務棧程式碼」的公開案例,工程細節(Triton/Gluon 內核、FpSan 驗證)具備一定可信度,但降本幅度本身建議保持謹慎。
降價對本地開發者有什麼影響?
對透過官方 API 或第三方中轉存取 GPT-5.6 的本地開發者而言,Luna、Terra 的調用成本明顯下降,尤其利好需要跑批量任務或 Agent 工作流的場景;但由於本地合規存取方式、匯率和平台加成不同,實際到手價格仍需以具體管道公示為準。
GPT-5.6 現在還比 Kimi K3、DeepSeek V4 Pro 貴嗎?
按單純 Token 報價,Luna 已低於多數國際競品,但仍高於 DeepSeek V4 系列;Sol 依然明顯高於 Kimi K3 和 DeepSeek V4 Pro。不過獨立評測顯示,若按「完成同等任務的實際花費」計算,Sol 與 Kimi K3 的實際成本差距會比單純 Token 單價的差距小很多。在專用節點上跑多模型路由,可查看MACCOME Mac 雲端租用方案。