GPT-5.6 全線降價:Sol 降 20%+、Terra 降 20%、Luna 降 80%,最新官方報價比 Claude Opus 5 便宜嗎?

OpenAI 在 2026 年 8 月 21 日正式把 GPT-5.6 Sol 的 API 報價再砍一刀:輸入從每百萬 token 5 美元降到 4 美元,輸出從 30 美元降到 20 美元,降幅超過 20%,促銷至少維持到 11 月 21 日。這是接續 7 月 30 日 Terra(降 20%)與 Luna(降 80%)降價之後,GPT-5.6 家族兩個月內的第二輪官方降價。降價後,Sol 的報價已經低於 Claude Opus 5($5 輸入/$25 輸出),但這不代表它就是「更便宜的選擇」——你還要看 Fast Mode、快取、長內容、Batch 這幾層計價規則,才能算出真正會付多少錢。
GPT-5.6 現在的完整報價:Sol、Terra、Luna 三個等級各多少
先把 2026 年 8 月官方最新報價攤開來看(每百萬 token,美元,Standard 模式):
短內容(Short context):
GPT-5.6 Sol:輸入 $4.00、快取輸入 $0.40、快取寫入 $5.00、輸出 $20.00
GPT-5.6 Terra:輸入 $2.00、快取輸入 $0.20、快取寫入 $2.50、輸出 $12.00
GPT-5.6 Luna:輸入 $0.20、快取輸入 $0.02、快取寫入 $0.25、輸出 $1.20
長內容(Long context,通常指超過某個 token 門檻的請求):
GPT-5.6 Sol:輸入 $8.00、快取輸入 $0.80、快取寫入 $10.00、輸出 $30.00
GPT-5.6 Terra:輸入 $4.00、快取輸入 $0.40、快取寫入 $5.00、輸出 $18.00
GPT-5.6 Luna:輸入 $0.40、快取輸入 $0.04、快取寫入 $0.50、輸出 $1.80
你會發現長內容的輸入價格剛好是短內容的兩倍,輸出則不是等比例放大(例如 Sol 輸出只從 20 漲到 30,不是 40),這代表官方對「輸出變長」跟「輸入變長」用了不同的漲幅邏輯,你在估算長文件、長對話的成本時不能只用「乘以 2」來簡化計算。
這不是第一次降價:兩個月內,OpenAI 分兩階段砍了 GPT-5.6 的價格
這次降價其實是接續動作,不是憑空發生:
7 月 30 日,OpenAI 官方在開發者社群公告,GPT-5.6 team 把「讓 GPT-5.6 自己優化自己的執行效率」這件事交給模型本身去做,得到兩個結果:透過生產環境 GPU kernel 改進,服務成本降低 20%;透過改進的推測解碼(speculative decoding),token 生成效率提升超過 15%。官方把這些效率提升直接反映到報價上:Luna 降價 80%、Terra 降價 20%,同時 Sol 新增了 Fast Mode(速度上限 2.5 倍於 Standard,價格是 Standard 的兩倍)。
8 月 21 日,官方再公告 Sol 本身降價超過 20%(輸入降 20%、輸出降 33%),並明確寫出「適用於 Fast Mode、長內容請求,以及 Batch 與 Flex 處理」,也就是這次降價不是只切一個入口價,而是整條計價曲線一起往下調。官方也說明這次調價「涵蓋 API、Codex 額度,並逐步擴大到符合資格的 ChatGPT Work 方案」,但 Pro、Plus、Business 訂閱制的用量方案價格不變——這提醒你,API 計費跟訂閱制消費版是兩套完全獨立的計價系統,一邊降價不會自動反映到另一邊。
Fast Mode(原名 Priority)比 Standard 貴多少,什麼時候該用
Fast Mode 是 2026 年 7 月 30 日由「Priority 處理」正式改名而來,你在 API 請求裡可以繼續用 service_tier: "priority",也可以換成新名字 service_tier: "fast",兩者等價。降價後的 Fast Mode 報價(短內容):
GPT-5.6 Sol:輸入 $8.00、快取輸入 $0.80、快取寫入 $10.00、輸出 $40.00
GPT-5.6 Terra:輸入 $4.00、快取輸入 $0.40、快取寫入 $5.00、輸出 $24.00
GPT-5.6 Luna:輸入 $0.40、快取輸入 $0.04、快取寫入 $0.50、輸出 $2.40
簡單說:Fast Mode 全面是 Standard 的兩倍價格,換來的是最高 2.5 倍的處理速度,模型智能程度不變。如果你的應用是即時客服、語音互動這種「使用者在等」的場景,多付一倍錢換更低延遲通常划算;如果是背景批次任務、離峰跑報表,花錢買速度就沒有意義,反而該往下一節的 Batch/Flex 走。
Batch 跟 Flex:省一半價格,代價是等待
Batch 與 Flex 處理模式的報價完全相同,都是 Standard 的五折(短內容):
GPT-5.6 Sol:輸入 $2.00、快取輸入 $0.20、快取寫入 $2.50、輸出 $10.00
GPT-5.6 Terra:輸入 $1.00、快取輸入 $0.10、快取寫入 $1.25、輸出 $6.00
GPT-5.6 Luna:輸入 $0.10、快取輸入 $0.01、快取寫入 $0.125、輸出 $0.60
差別在於 Batch 是非即時、非同步送出一批請求等待完成,適合報表彙整、大量文件摘要這類「不急著看到結果」的工作;Flex 則是官方另一種彈性處理模式,價格跟 Batch 相同但使用方式不同。這兩者都不適合需要即時回應使用者的場景。
Cyber 模型(Daybreak):另一套報價,不是每個人都用得到
GPT-5.6 家族還有一個獨立分支叫 Cyber 模型,對應官方的 Daybreak 專案,目前只有短內容報價:GPT-5.6 Sol 維持 $4.00/$0.40/$5.00/$20.00(跟一般 Sol 相同),而 GPT-5.6 Cyber 則是 $12.50 輸入/$1.25 快取輸入/$15.625 快取寫入/$75.00 輸出,明顯貴上好幾倍。官方文件也指出 daybreak-blue-latest 與 daybreak-red-latest 這兩個別名目前分別指向 gpt-5.6-sol 與 gpt-5.6-cyber,未來會隨 Daybreak 專案推出新模型而更新指向對象與報價。如果你的應用不涉及網路安全評測、紅隊演練這類 Daybreak 專案的目標場景,一般不需要碰到 Cyber 模型的報價。
促銷到 2026 年 11 月 21 日:之後價格會不會漲回去
官方文件明確寫著「GPT-5.6 Sol 的促銷價格至少維持到 2026 年 11 月 21 日」——注意這裡的用字是「at least(至少)」,代表官方沒有承諾促銷結束後價格一定會回到原本的 $5/$30,也沒有承諾會繼續維持在 $4/$20。在 OpenAI 官方開發者社群的討論串裡,工程師與開發者對此的看法也分成兩派:有人認為競爭壓力(尤其是開源模型與其他供應商的價格戰)會讓折扣延續下去;也有人認為 3 個月後很可能會有新一代模型上市,屆時舊模型的定價策略本身就會被取代。這件事目前沒有官方公告可以查證,屬於社群推測而非已證實事實,你在做超過 11 月的預算規劃時,建議把「維持折扣」與「恢復原價」兩種情境都算進去,不要只押注其中一種。
GPT-5.6 Sol 現在真的比 Claude Opus 5 便宜嗎
把兩邊官方報價放在一起看:GPT-5.6 Sol(Standard,短內容)是 $4.00 輸入/$20.00 輸出;Claude Opus 5(Standard)是 $5 輸入/$25 輸出。單看牌價,Sol 確實在輸入與輸出兩個維度都低於 Opus 5。但這個比較有兩個你要留意的限制:第一,兩家用的是不同的 tokenizer,同一段文字在 Sol 與 Opus 5 上產生的 token 數量不會完全相同,牌價便宜不代表同一份任務的實際帳單一定更低;第二,Claude Opus 5 提供 Batch 五折($2.50/$12.50)與最高 90% 的提示詞快取折扣,GPT-5.6 Sol 的 Batch 折扣同樣是五折($2.00/$10.00),快取折扣結構也不同(Sol 快取輸入是標準價的十分之一,Opus 5 的快取讀取則是輸入價的 0.1 倍、寫入依 5 分鐘或 1 小時分別是 1.25 倍或 2 倍)。真正該比較的不是官方公告的頭條數字,而是你實際工作負載跑出來的帳單。
企業採購決策:降價消息出來,你該馬上換模型嗎
看到降價新聞就想馬上把整條 pipeline 換過去,是最容易讓你花更多錢的反應。在換之前,先確認三件事:你目前的用量分布在哪個模式(Standard/Fast Mode/Batch),降價是否真的覆蓋到你在用的那個模式;你的任務對延遲的敏感度,如果本來就是背景任務,Fast Mode 的降價其實跟你無關;以及你是否使用了 Data Residency(資料落地)選項——官方文件註明 2026 年 3 月 5 日之後發布、且符合資格的模型走區域處理端點會加收 10% 費用,GPT-5.6 家族屬於這個範圍內,降價後的報價要再乘上 1.1 才是你實際的區域處理成本。把這三件事算清楚,再決定要不要動 pipeline。
常見問題
Q1:這次降價後,我之前買的 ChatGPT Work 或 Codex 額度會自動變便宜嗎?
官方公告寫的是「適用於 API、Codex 額度,並逐步擴大到符合資格的 ChatGPT Work 方案」,但 Pro、Plus、Business 訂閱制的用量方案價格不變。也就是說,如果你用的是 API 或 Codex 額度,降價通常會自動反映;但如果你是訂閱制使用者,這次降價不影響你的訂閱費用。
Q2:促銷結束後(2026 年 11 月 21 日)價格一定會漲回 $5/$30 嗎?
官方目前沒有公告促銷結束後的處置方式,只說促銷「至少」維持到那個日期。這是尚未證實的未來事件,你可以參考但不該當成確定事實來做長期預算規劃。
Q3:Fast Mode 跟以前的 Priority 處理是不是同一個東西?
是的。官方文件註明「Priority processing was renamed Fast mode on July 30, 2026」,API 參數 service_tier 可以繼續用 "priority",也可以改用新名稱 "fast",效果相同。
Q4:這次降價也適用 Batch 跟長內容嗎?
適用。官方 8 月 21 日公告原文提到「價格下調也適用於 Fast Mode、長內容請求,以及 Batch 與 Flex 處理」,本文上方列出的各模式報價已經是降價後的官方最新數字。
Q5:GPT-5.6 Sol 現在真的比 Claude Opus 5 便宜嗎?
以官方牌價比較,Sol 的輸入與輸出單價都低於 Opus 5。但因為兩家 tokenizer 不同、快取與 Batch 折扣結構也不同,實際總花費要以你自己工作負載試跑出來的帳單為準,不能只看頭條單價。
Q6:GPT-5.6 Cyber 跟一般 Sol 差在哪,我該注意嗎?
Cyber 是對應 Daybreak 專案(網路安全評測相關)的獨立模型分支,報價明顯高於一般 Sol(輸出達 $75),且只有短內容報價。如果你的應用不涉及資安評測或紅隊測試場景,一般不會用到、也不需要特別關注這個報價。
資料來源聲明
本文數字截至 2026 年 8 月 25 日查證,依據以下官方來源:
OpenAI 官方報價頁 Pricing | OpenAI API(查證日期:2026-08-25)
OpenAI Developer Community 官方公告《20% price reduction for GPT 5.6 Sol: API, Codex credits and ChatGPT Work》,發布於 2026 年 8 月 21 日(查證日期:2026-08-25)
OpenAI Developer Community 官方公告《Announcing a major Price drop for 5.6 Terra and Luna and Fast mode for 5.6-Sol》,發布於 2026 年 7 月 30 日(查證日期:2026-08-25)
Anthropic 官方報價頁 Pricing - Claude Platform Docs(查證日期:2026-08-25),作為 Claude Opus 5 比較數字的依據
延伸閱讀
如果你正在評估要不要因為這次降價調整模型組合,或想先搞懂自己目前的 Token 用量到底花在哪裡,歡迎到 Ai Token 免費試用,先把帳單看懂,再決定要不要換。

留言