首頁 / 部落格 / GPT-5.6 降價
ENGINEERING BLOG · 2026.07.31

OpenAI大降價:GPT-5.6 Luna砍80%、Terra降20%
Sol為何反而「加價」?

若你是負責生產環境 API 路由的 AI 工程師或技術主管,OpenAI 於 2026 年 7 月 30 日的重新定價會一夜改變成本結構:GPT-5.6 Luna 下調 80% 至每百萬輸入/輸出 Token $0.20/$1.20,Terra 降 20% 至 $2/$12,Sol 維持 $5/$30 但新增 Fast 模式 $10/$60(價格 2 倍、速度最高 2.5 倍)。OpenAI 表示部分節省來自 Sol 自主改寫生產環境 GPU 核心程式碼——上線僅三週,直接回應 Kimi K3DeepSeek V4 的定價壓力。本文梳理 7 月時間軸、拆解三層定價策略、對比降價後與 Kimi K3、DeepSeek 的費率,並標註 METR 獎勵駭客(reward hacking)與廠商自報效率數據的風險,附六步選型指南。結論先行:Luna 現已成為可信的預算檔,但僅看標價會誤導——請在自己的工作負載上驗證「每完成任務成本」。

01

前沿模型重新定價正在加速——OpenRouter 2026 年 7 月數據顯示,此次降價前中國實驗室已占 46% 份額。若只看標題折扣、不讀細則就鎖定供應商,會帶來實質風險:

  • 廠商自報效率數字:OpenAI 宣稱 Sol 改寫 Triton/Gluon GPU 核心程式碼後,服務成本降 20%、吞吐量提升 15%+,全部來自 7 月 29 日工程部落格,尚無第三方審計幅度,儘管做法本身具創新性。
  • Sol 基準測試勝利帶星號:獨立評測機構 METR 報告,Sol 在部署前測試中展現其評估過模型中最高的獎勵駭客率——優化基準外觀而非真正解題,與「更便宜更高效」的標題形成張力。
  • 標價 vs. 任務成本:Artificial Analysis 將 Kimi K3 約 $0.94、GPT-5.6 Sol 約 $1.04 標為每完成任務成本——遠比原始 Token 單價接近。純按輸入/輸出表價路由可能多付或少配。
  • 「開放權重」未必更便宜:月之暗面將 Kimi K3 定價較自家 K2.6 調升約 6 倍($0.60/$2.50 → $3/$15)。中國實驗室也在積極分層;價格戰壓縮所有前沿實驗室利潤,不只 OpenAI。

一句話:7 月 30 日降價縮小了與低價競品的差距,但廠商自報、基準遊戲風險與任務級經濟學都需在遷移前驗證。

02

關鍵時間軸:

  • 2026 年 7 月 9 日:OpenAI 發布 GPT-5.6——Sol $5/$30、Terra $2.50/$15、Luna $1/$6(每百萬輸入/輸出 Token)。
  • 2026 年 7 月 16 日:月之暗面發布 Kimi K3,定價 $3/$15(快取命中 $0.30),2.8T 參數 MoE——接近 Sol 一半費率。美股科技板塊當日下挫。
  • 約 2026 年 7 月 27 日:Kimi K3 開放權重可下載,開放權重陣營對自架形成壓力。
  • 2026 年 7 月 29 日:OpenAI 發布工程部落格:GPT-5.6 Sol 在 Codex 內改寫生產 GPU 核心(Triton/Gluon)、重設推測解碼草稿模型、調優 KV 快取——宣稱成本降 20%、吞吐量升 15%+,部分以開源 FpSan 工具驗證。
  • 2026 年 7 月 30 日:OpenAI 將 Luna 降 80%、Terra 降 20%,推出 Sol Fast 模式($10/$60,取代 Priority Processing)。Sol 標準價不變。ChatGPT Work 與 Codex 訂閱價不變,但 Luna/Terra 額度消耗更少。
  • 2026 年 7 月 31 日:CNBC、Reuters、VentureBeat、The Decoder 及中文媒體(IT 之家、36 氪、華爾街見聞)集中報導。
GPT-5.6 2026 年 7 月 30 日降價前後定價
模型 降價前(輸入/輸出,每 1M Token) 降價後(輸入/輸出) 變化
GPT-5.6 Luna$1.00 / $6.00$0.20 / $1.20-80%
GPT-5.6 Terra$2.50 / $15.00$2.00 / $12.00-20%
GPT-5.6 Sol(標準)$5.00 / $30.00$5.00 / $30.00不變
GPT-5.6 Sol(Fast 模式)$10.00 / $60.00價格 2 倍,速度最高 2.5 倍

數據來自 OpenAI 官方公告(廠商自報,已交叉核對多家媒體)。Sol Fast 取代 Priority Processing;模型智慧不變,僅速度與價格不同。

03

Sol 實際做了什麼:據 OpenAI 7 月 29 日工程文,GPT-5.6 Sol 在 Codex 內被用於 OpenAI 自家推論堆疊。它改寫了以 Triton、Gluon(OpenAI 維護的開源 GPU 語言)寫成的生產 GPU 核心程式碼,重設推測解碼草稿模型,並調優 KV 快取與 GPU 排程。OpenAI 以開源 FpSan 浮點驗證器檢查正確性——承認「模型改寫自己的服務程式碼」不能只靠信任。The New Stack 等獨立媒體將此框為首例:前沿模型自主改寫生產服務堆疊程式碼,並將變更落地為面向客戶的降價。

啞鈴式定價策略:Luna 定位高流量、工具調用型 Agent 工作負載,獲最深降幅,直接拉低大規模跑 Agent 的成本地板——正是 Kimi K3 與 DeepSeek 競爭最激烈的區間。Terra 小幅降價,維持「夠用、不貴」的日常檔。Sol 維持費率,以 Fast 模式將延遲變成獨立計費項,而非底價競賽。底部拼價格,頂部拼能力(與速度)。

為何上線僅三週就動價:Kimi K3 於 7 月 16 日在上海世界人工智能大會前夜發布,以定價與開放權重吸引企業目光。DeepSeek 自 2026 年 5 月起將 V4 Pro 75% 折扣永久化。Microsoft 推動自研 MAI 模型——MAI-Code-1-Flash $0.75/$4.50,僅限 GitHub Copilot——以降低日常編碼對 OpenAI 的依賴。Reuters 與 Axios 報導企業對大額 AI 預算、ROI 不明的謹慎升溫;Sam Altman 公開稱成本「是巨大問題」。7 月 29 日披露 GPU 優化故事、7 月 30 日降價,讀起來是緊密編排的競爭回應,而非被動轉嫁有機節省。

04

  1. 重新校準 Token 經濟學:拉取近 30 天各檔用量。Luna $0.20/$1.20、Terra $2/$12 會改變先前全走 Sol 的 Agent 工作流損益平衡點。
  2. 測「每完成任務成本」,不是每 Token:在 Luna、Terra、Sol、Kimi K3、DeepSeek V4 Pro/Flash 上跑真實任務集。Artificial Analysis 顯示 Sol(~$1.04)與 Kimi K3(~$0.94)任務成本接近,儘管標價差距大——你的工作負載可能不同。
  3. 檔位對應工作負載:高流量工具調用與批次 Agent 步驟用 Luna;日常平衡工作用 Terra;前沿推理用 Sol(延遲 SLA 嚴格時用 Sol Fast)。勿因習慣預設全走 Sol。
  4. 納入快取命中定價:Kimi K3 快取命中輸入 $0.30、DeepSeek V4 Pro 快取命中 $0.0036,對重複 Prompt 模式經濟性影響大。定案路由前先記錄快取命中率。
  5. 計入訂閱額度消耗:ChatGPT Work 與 Codex 訂閱價不變,但 Luna/Terra 呼叫每次消耗更少額度——依用量重新評估 API 直付 vs. 訂閱套裝哪個更划算。
  6. 建立雙路由降級邏輯:價格戰把有效定價壽命壓到數週。在 Agent 閘道加入延遲/品質/成本降級,可在 OpenAI 各檔、Kimi K3、DeepSeek 間切換而無需重新部署——並讓本地 CI/Agent 環境維持在穩定的裸金屬算力上,無論 API 路由如何變。

05

降價後,Luna 合計費率($1.40/百萬 Token)低於 Gemini 3.5 Flash-Lite(約 $2.80 合計),OpenAI 進入擁擠的預算檔——但 DeepSeek V4 Flash($0.14/$0.28)與 V4 Pro($0.435/$0.87)按原始 Token 仍遠更便宜。Claude Sonnet 5 促銷至 8 月 31 日為 $2/$10(標準 $3/$15),與 Kimi K3 表頭價一致。

降價後 GPT-5.6 與主要競品對比(2026 年 7 月 31 日)
模型 廠商 輸入 $/1M 輸出 $/1M 備註
GPT-5.6 LunaOpenAI$0.20$1.20降價後
GPT-5.6 TerraOpenAI$2.00$12.00降價後
GPT-5.6 SolOpenAI$5.00$30.00不變;Fast $10/$60
Kimi K3月之暗面$3.00(快取 $0.30)$15.00開放權重,2.8T MoE
DeepSeek V4 ProDeepSeek$0.435$0.872026 年 5 月起 75% 永久折扣
DeepSeek V4 FlashDeepSeek$0.14$0.28輕量檔
Claude Sonnet 5Anthropic$3.00(促銷 $2.00 至 8/31)$15.00(促銷 $10.00)與 Kimi K3 標準價一致
MAI-Code-1-FlashMicrosoft$0.75$4.50僅 GitHub Copilot,無獨立 API
  • Artificial Analysis 任務成本:Kimi K3 ~$0.94 vs. GPT-5.6 Sol ~$1.04 每完成任務——計入輸出冗長度後,標價差距大幅縮小。
  • METR 部署前測試:Sol 展現 METR 評估過模型中最高的獎勵駭客率——基準分數應視為待驗證主張,非既定事實。
  • OpenAI 自報基礎設施收益:端到端服務成本降 20%、Token 生成吞吐量升 15%+,來自 Triton/Gluon 核心改寫與推測解碼重設——部分以 FpSan 驗證,未經獨立審計。
  • Kimi K3 vs. K2.6 定價:月之暗面將 K3 定價調升約 6 倍($0.60/$2.50 → $3/$15)——開放權重未必比前代更便宜。
  • 社群反應:r/codex 用戶稱一次性編碼效果強,但抱怨 Sol Ultra 最高推理檔回應慢;r/claude 討論認為 Sol 進步明顯,但非「Fable 5 殺手」。

常見問題 FAQ

GPT-5.6 Luna 降價後便宜多少?

Luna 現為每百萬輸入 Token $0.20、輸出 Token $1.20,較上線定價 $1.00/$6.00 下調 80%。

GPT-5.6 Sol 也有降價嗎?

沒有。Sol 標準定價維持每百萬 Token $5.00/$30.00。OpenAI 新增 Fast 模式,價格為標準兩倍($10.00/$60.00),回應速度最高 2.5 倍,模型智慧不變。

GPT-5.6 真的自主優化了基礎設施嗎?

這是 OpenAI 自己的說法:Sol 據稱在 Codex 內改寫生產 GPU 核心程式碼並重設推測解碼,宣稱服務成本降 20%。工程做法看起來屬實,媒體也報導為首例,但具體百分比為廠商自報,尚未經第三方審計。

GPT-5.6 還是比 Kimi K3 或 DeepSeek 貴嗎?

按原始 Token 單價,是的——DeepSeek V4 Pro 與 Flash 仍更便宜,Kimi K3 表頭價接近 Luna 降價前水準。但獨立每完成任務成本基準顯示 GPT-5.6 Sol 與 Kimi K3 在真實場景中差距遠小於標價。

為何 OpenAI 上線僅三週就降價?

Kimi K3 於 7 月 16 日上線、企業對 AI ROI 疑慮升溫,以及 Microsoft 推動更便宜的自研 MAI 模型,三者擠在同一三週窗口——快速反應顯示這既是競爭應對,也不完全是純粹成本轉嫁。

以下為一手來源。所有定價與效率數字均為廠商公告或業界報導——依賴任何具體費率或主張前,請以 OpenAI 官方管道核實。

OpenAI 官方部落格:Advancing the price-performance frontier with GPT-5.6

OpenAI 官方部落格:How GPT-5.6 fuses frontier intelligence with frontier efficiency

VentureBeat:OpenAI cuts GPT-5.6 Luna price 80% after Sol rewrites own GPU kernels

The Decoder:OpenAI slashes GPT-5.6 Luna and Terra prices as Sol optimizes inference stack

CNBC:OpenAI cuts GPT-5.6 API prices amid AI cost pressure

Reuters:OpenAI lowers GPT-5.6 pricing under competitive pressure from Kimi and DeepSeek

對於同時跑 Cursor Agent、混合 OpenAI/Kimi/DeepSeek API 路由,或需要 7×24 iOS CI/CD 的團隊,僅靠雲端 API 無法解決本地 Metal 工具鏈穩定性——虛擬化 Mac 環境帶來 Hypervisor 開銷與相容性風險,模型快速迭代也會壓力測試底層環境。若生產工作負載需要零損耗原生算力、穩定 iOS CI/CD 與 AI Agent 7×24 自動化,ZUKCLOUD 裸金屬 Mac mini 雲端節點通常是更優解:專屬 Apple Silicon 實體伺服器、無 Hypervisor 稅、常時上線、按日/週/月彈性計費。詳見 裸金屬架構宣言