top of page

GPT-5.6 全線降價:Sol 降 20%+、Terra 降 20%、Luna 降 80%,最新官方報價比 Claude Opus 5 便宜嗎?

8月25日
讀畢需時 7 分鐘
AI 網路與資料連接示意圖,中間有平衡秤與定價圖表,象徵 AI 模型定價比較

OpenAI 在 2026 年 8 月 21 日正式把 GPT-5.6 Sol 的 API 報價再砍一刀:輸入從每百萬 token 5 美元降到 4 美元,輸出從 30 美元降到 20 美元,降幅超過 20%,促銷至少維持到 11 月 21 日。這是接續 7 月 30 日 Terra(降 20%)與 Luna(降 80%)降價之後,GPT-5.6 家族兩個月內的第二輪官方降價。降價後,Sol 的報價已經低於 Claude Opus 5($5 輸入/$25 輸出),但這不代表它就是「更便宜的選擇」——你還要看 Fast Mode、快取、長內容、Batch 這幾層計價規則,才能算出真正會付多少錢。

GPT-5.6 現在的完整報價:Sol、Terra、Luna 三個等級各多少

先把 2026 年 8 月官方最新報價攤開來看(每百萬 token,美元,Standard 模式):

短內容(Short context):

  • GPT-5.6 Sol:輸入 $4.00、快取輸入 $0.40、快取寫入 $5.00、輸出 $20.00

  • GPT-5.6 Terra:輸入 $2.00、快取輸入 $0.20、快取寫入 $2.50、輸出 $12.00

  • GPT-5.6 Luna:輸入 $0.20、快取輸入 $0.02、快取寫入 $0.25、輸出 $1.20

長內容(Long context,通常指超過某個 token 門檻的請求):

  • GPT-5.6 Sol:輸入 $8.00、快取輸入 $0.80、快取寫入 $10.00、輸出 $30.00

  • GPT-5.6 Terra:輸入 $4.00、快取輸入 $0.40、快取寫入 $5.00、輸出 $18.00

  • GPT-5.6 Luna:輸入 $0.40、快取輸入 $0.04、快取寫入 $0.50、輸出 $1.80

你會發現長內容的輸入價格剛好是短內容的兩倍,輸出則不是等比例放大(例如 Sol 輸出只從 20 漲到 30,不是 40),這代表官方對「輸出變長」跟「輸入變長」用了不同的漲幅邏輯,你在估算長文件、長對話的成本時不能只用「乘以 2」來簡化計算。

這不是第一次降價:兩個月內,OpenAI 分兩階段砍了 GPT-5.6 的價格

這次降價其實是接續動作,不是憑空發生:

7 月 30 日,OpenAI 官方在開發者社群公告,GPT-5.6 team 把「讓 GPT-5.6 自己優化自己的執行效率」這件事交給模型本身去做,得到兩個結果:透過生產環境 GPU kernel 改進,服務成本降低 20%;透過改進的推測解碼(speculative decoding),token 生成效率提升超過 15%。官方把這些效率提升直接反映到報價上:Luna 降價 80%、Terra 降價 20%,同時 Sol 新增了 Fast Mode(速度上限 2.5 倍於 Standard,價格是 Standard 的兩倍)。

8 月 21 日,官方再公告 Sol 本身降價超過 20%(輸入降 20%、輸出降 33%),並明確寫出「適用於 Fast Mode、長內容請求,以及 Batch 與 Flex 處理」,也就是這次降價不是只切一個入口價,而是整條計價曲線一起往下調。官方也說明這次調價「涵蓋 API、Codex 額度,並逐步擴大到符合資格的 ChatGPT Work 方案」,但 Pro、Plus、Business 訂閱制的用量方案價格不變——這提醒你,API 計費跟訂閱制消費版是兩套完全獨立的計價系統,一邊降價不會自動反映到另一邊。

Fast Mode(原名 Priority)比 Standard 貴多少,什麼時候該用

Fast Mode 是 2026 年 7 月 30 日由「Priority 處理」正式改名而來,你在 API 請求裡可以繼續用 service_tier: "priority",也可以換成新名字 service_tier: "fast",兩者等價。降價後的 Fast Mode 報價(短內容):

  • GPT-5.6 Sol:輸入 $8.00、快取輸入 $0.80、快取寫入 $10.00、輸出 $40.00

  • GPT-5.6 Terra:輸入 $4.00、快取輸入 $0.40、快取寫入 $5.00、輸出 $24.00

  • GPT-5.6 Luna:輸入 $0.40、快取輸入 $0.04、快取寫入 $0.50、輸出 $2.40

簡單說:Fast Mode 全面是 Standard 的兩倍價格,換來的是最高 2.5 倍的處理速度,模型智能程度不變。如果你的應用是即時客服、語音互動這種「使用者在等」的場景,多付一倍錢換更低延遲通常划算;如果是背景批次任務、離峰跑報表,花錢買速度就沒有意義,反而該往下一節的 Batch/Flex 走。

Batch 跟 Flex:省一半價格,代價是等待

Batch 與 Flex 處理模式的報價完全相同,都是 Standard 的五折(短內容):

  • GPT-5.6 Sol:輸入 $2.00、快取輸入 $0.20、快取寫入 $2.50、輸出 $10.00

  • GPT-5.6 Terra:輸入 $1.00、快取輸入 $0.10、快取寫入 $1.25、輸出 $6.00

  • GPT-5.6 Luna:輸入 $0.10、快取輸入 $0.01、快取寫入 $0.125、輸出 $0.60

差別在於 Batch 是非即時、非同步送出一批請求等待完成,適合報表彙整、大量文件摘要這類「不急著看到結果」的工作;Flex 則是官方另一種彈性處理模式,價格跟 Batch 相同但使用方式不同。這兩者都不適合需要即時回應使用者的場景。

Cyber 模型(Daybreak):另一套報價,不是每個人都用得到

GPT-5.6 家族還有一個獨立分支叫 Cyber 模型,對應官方的 Daybreak 專案,目前只有短內容報價:GPT-5.6 Sol 維持 $4.00/$0.40/$5.00/$20.00(跟一般 Sol 相同),而 GPT-5.6 Cyber 則是 $12.50 輸入/$1.25 快取輸入/$15.625 快取寫入/$75.00 輸出,明顯貴上好幾倍。官方文件也指出 daybreak-blue-latest 與 daybreak-red-latest 這兩個別名目前分別指向 gpt-5.6-sol 與 gpt-5.6-cyber,未來會隨 Daybreak 專案推出新模型而更新指向對象與報價。如果你的應用不涉及網路安全評測、紅隊演練這類 Daybreak 專案的目標場景,一般不需要碰到 Cyber 模型的報價。

促銷到 2026 年 11 月 21 日:之後價格會不會漲回去

官方文件明確寫著「GPT-5.6 Sol 的促銷價格至少維持到 2026 年 11 月 21 日」——注意這裡的用字是「at least(至少)」,代表官方沒有承諾促銷結束後價格一定會回到原本的 $5/$30,也沒有承諾會繼續維持在 $4/$20。在 OpenAI 官方開發者社群的討論串裡,工程師與開發者對此的看法也分成兩派:有人認為競爭壓力(尤其是開源模型與其他供應商的價格戰)會讓折扣延續下去;也有人認為 3 個月後很可能會有新一代模型上市,屆時舊模型的定價策略本身就會被取代。這件事目前沒有官方公告可以查證,屬於社群推測而非已證實事實,你在做超過 11 月的預算規劃時,建議把「維持折扣」與「恢復原價」兩種情境都算進去,不要只押注其中一種。

GPT-5.6 Sol 現在真的比 Claude Opus 5 便宜嗎

把兩邊官方報價放在一起看:GPT-5.6 Sol(Standard,短內容)是 $4.00 輸入/$20.00 輸出;Claude Opus 5(Standard)是 $5 輸入/$25 輸出。單看牌價,Sol 確實在輸入與輸出兩個維度都低於 Opus 5。但這個比較有兩個你要留意的限制:第一,兩家用的是不同的 tokenizer,同一段文字在 Sol 與 Opus 5 上產生的 token 數量不會完全相同,牌價便宜不代表同一份任務的實際帳單一定更低;第二,Claude Opus 5 提供 Batch 五折($2.50/$12.50)與最高 90% 的提示詞快取折扣,GPT-5.6 Sol 的 Batch 折扣同樣是五折($2.00/$10.00),快取折扣結構也不同(Sol 快取輸入是標準價的十分之一,Opus 5 的快取讀取則是輸入價的 0.1 倍、寫入依 5 分鐘或 1 小時分別是 1.25 倍或 2 倍)。真正該比較的不是官方公告的頭條數字,而是你實際工作負載跑出來的帳單。

企業採購決策:降價消息出來,你該馬上換模型嗎

看到降價新聞就想馬上把整條 pipeline 換過去,是最容易讓你花更多錢的反應。在換之前,先確認三件事:你目前的用量分布在哪個模式(Standard/Fast Mode/Batch),降價是否真的覆蓋到你在用的那個模式;你的任務對延遲的敏感度,如果本來就是背景任務,Fast Mode 的降價其實跟你無關;以及你是否使用了 Data Residency(資料落地)選項——官方文件註明 2026 年 3 月 5 日之後發布、且符合資格的模型走區域處理端點會加收 10% 費用,GPT-5.6 家族屬於這個範圍內,降價後的報價要再乘上 1.1 才是你實際的區域處理成本。把這三件事算清楚,再決定要不要動 pipeline。

常見問題

Q1:這次降價後,我之前買的 ChatGPT Work 或 Codex 額度會自動變便宜嗎?

官方公告寫的是「適用於 API、Codex 額度,並逐步擴大到符合資格的 ChatGPT Work 方案」,但 Pro、Plus、Business 訂閱制的用量方案價格不變。也就是說,如果你用的是 API 或 Codex 額度,降價通常會自動反映;但如果你是訂閱制使用者,這次降價不影響你的訂閱費用。

Q2:促銷結束後(2026 年 11 月 21 日)價格一定會漲回 $5/$30 嗎?

官方目前沒有公告促銷結束後的處置方式,只說促銷「至少」維持到那個日期。這是尚未證實的未來事件,你可以參考但不該當成確定事實來做長期預算規劃。

Q3:Fast Mode 跟以前的 Priority 處理是不是同一個東西?

是的。官方文件註明「Priority processing was renamed Fast mode on July 30, 2026」,API 參數 service_tier 可以繼續用 "priority",也可以改用新名稱 "fast",效果相同。

Q4:這次降價也適用 Batch 跟長內容嗎?

適用。官方 8 月 21 日公告原文提到「價格下調也適用於 Fast Mode、長內容請求,以及 Batch 與 Flex 處理」,本文上方列出的各模式報價已經是降價後的官方最新數字。

Q5:GPT-5.6 Sol 現在真的比 Claude Opus 5 便宜嗎?

以官方牌價比較,Sol 的輸入與輸出單價都低於 Opus 5。但因為兩家 tokenizer 不同、快取與 Batch 折扣結構也不同,實際總花費要以你自己工作負載試跑出來的帳單為準,不能只看頭條單價。

Q6:GPT-5.6 Cyber 跟一般 Sol 差在哪,我該注意嗎?

Cyber 是對應 Daybreak 專案(網路安全評測相關)的獨立模型分支,報價明顯高於一般 Sol(輸出達 $75),且只有短內容報價。如果你的應用不涉及資安評測或紅隊測試場景,一般不會用到、也不需要特別關注這個報價。

資料來源聲明

本文數字截至 2026 年 8 月 25 日查證,依據以下官方來源:

延伸閱讀

如果你正在評估要不要因為這次降價調整模型組合,或想先搞懂自己目前的 Token 用量到底花在哪裡,歡迎到 Ai Token 免費試用,先把帳單看懂,再決定要不要換。

最新文章

查看全部
DeepSeek V4.1-Flash 上線:官方定價不漲反降,V4-Pro 將被悄悄取代,帳單怎麼跟著變?

DeepSeek 已於 2026 年 9 月 10 日 04:00 UTC 正式推出新一代模型 V4.1-Flash,同步生效的新定價不是漲價,而是比一個月前才調整過的 V4-Flash 價格再往下降:輸出 token 便宜約 9%,快取未命中(cache-miss)輸入 token 便宜約 32%。更關鍵的是,DeepSeek 官方已經宣布從 9 月 14 日中午(北京時間)起,所有打到 dee

 
 
 
SpaceXAI(原xAI)Grok 4.6 API 官方定價全解析:輸出價每M僅$6,比 Claude、GPT-6 便宜多少?

Grok 4.6 的 API 定價是短內容(低於20萬token)輸入每百萬token 2美元、輸出6美元,超過20萬token的長內容則整段請求改按輸入4美元、輸出12美元計費;如果你只看輸出token的價格,Grok 4.6 比 Claude Fable 5.1、GPT-6 Astra 便宜超過八成,是目前主流旗艦模型裡數一數二便宜的選擇。你可能也發現,現在查詢這些資料時,官方文件網域已經不叫

 
 
 
GLM-5.3、Kimi K3 官方定價曝光:除了 DeepSeek,這兩款中國大模型你也該認識

如果你對中國大模型的認識還停留在「DeepSeek 很便宜」,那你可能漏掉了兩個這半年陸續上線、定價同樣壓得很低的競爭者:Zhipu(智譜)旗下的 GLM-5.3,以及 Moonshot AI 的 Kimi K3。GLM-5.3 官方標準定價是每百萬 token 輸入 1.4 美元、輸出 4.4 美元,其中鎖定輕量任務的 GLM-5.3-Flash 目前還在五折優惠期,但優惠將在今天(2026 年

 
 
 

留言


bottom of page