top of page

Claude Fable 5.1 正式上線:定價沒漲,帳單卻可能省 25%~45%?一次搞懂新模型改了什麼

9月3日
讀畢需時 8 分鐘

Claude Fable 5.1 是 Anthropic 於 2026 年 9 月 1 日推出的最新旗艦模型,接替 Claude Fable 5 成為官方目前最強、也最貴的模型。它的每百萬 token 牌價維持不變:輸入 10 美元、輸出 50 美元,但透過把「快取讀取」(cache read)費率大砍 75%,官方估計典型工作負載的整體成本可降低約 25%,高度倚賴 AI Agent、長時間自主作業的工作負載,省下的幅度最高可到約 45%。同時上線的還有僅限受邀對象使用的 Claude Mythos 5.1。如果你的團隊已經在用 Fable 5,這篇文章一次講清楚:定價實際上怎麼變、規格差在哪、升級要不要改程式碼,以及企業導入時該留意的新規定。

Claude Fable 5.1 是什麼?跟 Fable 5、Mythos 5.1 差在哪裡

根據 Anthropic 官方公告,Claude Fable 5.1 與 Claude Mythos 5.1 是「同一個模型,只是安全防護層級不同」。Fable 5.1 是一般開發者與企業都能使用的公開版本;Mythos 5.1 則只開放給通過「信任存取計畫」審核的資安與生命科學領域組織,目前僅限美國境內機構,Anthropic 表示正與美國政府協調擴大到更多國內外夥伴。

官方定位 Fable 5.1 用於「高強度推理與長時間自主代理工作」:處理需要跑數小時、橫跨多個應用程式、不能抄捷徑的任務,例如長篇程式除錯、多步驟研究、或大量文件與簡報產出。Anthropic 同時建議:多數一般工作負載應該先從 Claude Opus 5 開始評估,只有在 Opus 5 用高強度模式仍不夠用時,才需要上到 Fable 5.1。

定價到底變了什麼?Cache Read 降 75% 是什麼意思

Fable 5.1 的基礎輸入、輸出價格跟 Fable 5 完全一樣,沒有調漲也沒有調降:每百萬輸入 token 10 美元、輸出 50 美元。真正改變的是「快取讀取」(模型重複讀取先前已處理過的內容時的計價):Fable 5 的快取讀取是標準輸入價的 0.1 倍(即每百萬 token 1 美元),Fable 5.1 降到 0.025 倍,也就是每百萬 token 0.25 美元,降幅達 75%。5 分鐘與 1 小時的快取寫入費率則維持不變,分別是每百萬 token 12.5 美元與 20 美元。

換句話說,如果你的應用大量依賴前後文快取(例如長對話、重複讀取同一份文件或系統提示),帳單降幅會很明顯;如果你的用量本來就很少用到快取,這次調整對你的影響有限。

官方案例:同樣的工作負載,帳單省 25% 還是 45%,差在哪

Anthropic 官方用 2026 年 8 月一整個月的實際用量資料做了對照:「典型工作負載」(涵蓋 Claude Enterprise、Claude Code、API 的一般 Fable 用量)換算後的成本指數,從 Fable 5 的 100 降到 Fable 5.1 的 75,也就是省下約 25%;「高度代理型工作負載」(大量倚賴前後文、工具呼叫頻繁、快取讀取占成本大宗的場景)指數則從 100 降到 55,省下約 45%。

關鍵在於:你的帳單裡快取讀取佔比越高,這次降價感受越明顯。如果團隊本來就用 Prompt Caching 處理長系統提示或重複性高的任務,實際省下的比例可能比官方公布的「典型」數字更接近「高度代理型」那一端。

規格一次看:Context Window、輸出上限、知識截止日期

根據 Claude Platform Docs 的模型總覽頁,Fable 5.1 的規格如下:Context Window 為 100 萬 token,最大輸出 12.8 萬 token,思考模式為「自適應(Adaptive,恆常啟用)」,預設強度為 high,延遲表現屬於四款主力模型中最慢的一個,可靠知識截止日期為 2026 年 6 月,正式上線日為 2026 年 9 月 1 日,官方承諾最快也要到 2027 年 9 月 1 日才會考慮退役。

對照同系列其他模型:Claude Opus 5 同樣是 100 萬 Context Window、12.8 萬最大輸出,價格為每百萬 5 美元/25 美元,延遲「中等」;Claude Sonnet 5 一樣是 100 萬 Context Window,價格每百萬 2 美元/10 美元,延遲最快;Claude Haiku 4.5 的 Context Window 則只有 20 萬 token,最大輸出 6.4 萬 token,價格每百萬 1 美元/5 美元。

官方公布的六項跑分:Fable 5.1 對比 Fable 5、Opus 5、GPT-5.6 Sol 表現如何

Anthropic 在發表文章中公布了六項基準測試的官方成績,同時列出 Fable 5、Opus 5 與 OpenAI GPT-5.6 Sol 的對照數字:在「Terminal-Bench-Science 0.1」(代理型科學研究)上,Fable 5.1 拿下 52.6%,遠高於 Fable 5 的 24.7%、Opus 5 的 29.0%、GPT-5.6 Sol 的 22.4%;在「Terminal-Bench 4.0」(代理型程式撰寫)上,Fable 5.1 為 55.8%(Mythos 5.1 為 60.9%),高於 Fable 5 的 42.0%、Opus 5 的 52.3%、GPT-5.6 Sol 的 37.3%;「GDPval-AA v2」(知識工作)Fable 5.1 得 1853 分,Fable 5 為 1723、Opus 5 為 1824、GPT-5.6 Sol 為 1711;「Humanity's Last Exam」(多領域推理,含工具)Fable 5.1 為 65.0%,Fable 5 為 63.8%,Opus 5 為 63.6%;「AutomationBench」(企業流程自動化)Fable 5.1 為 31.4%,Fable 5 為 17.1%,Opus 5 為 26.9%,GPT-5.6 Sol 為 19.6%;「CursorBench 3.2.0」(代理型程式撰寫)Fable 5.1 為 73.4%,Fable 5 為 70.5%,Opus 5 為 70.0%,GPT-5.6 Sol 為 67.2%。

官方特別註明,這些跑分是在 Fable 5.1 開啟正式安全防護機制下測得,若任務被防護機制介入(例如部分資安或生物領域任務),Fable 5.1 與 Fable 5 在該題項會直接算 0 分,實際能力可能被低估。

從 Fable 5 升級到 5.1,程式碼要改嗎?3 個破壞性變更

如果你目前的系統已經串接 Claude Fable 5 的 API,官方文件列出三項「破壞性變更」需要注意:第一,強制工具呼叫(forced tool use)在 Fable 5.1 上會直接回傳錯誤,不再支援;第二,較舊版本的模型無法讀取 Fable 5.1 產生的思考內容(thinking blocks);第三,編輯先前對話回合的內容,會讓該回合之後的思考內容失效。

另外官方也列出五項「新增功能」:可在對話中途變更強度等級的「per-message effort」(測試版)、限定單一回合生效的系統訊息(測試版)、工具呼叫之間可顯示可讀進度更新的功能(測試版)、前面提到的快取讀取降價,以及內容來源標記(content provenance)機制。模型 ID 為 claude-fable-5-1,在 Amazon Bedrock 上對應 anthropic.claude-fable-5-1,Google Cloud 與 Microsoft Foundry 上則同樣是 claude-fable-5-1。

資安與資料留存的新機制:Enterprise Frontier Safeguards 是什麼

這次發表另一個重點是「Enterprise Frontier Safeguards」(EFS,企業前沿防護機制)。官方說明 EFS 讓企業客戶的資料完全儲存在客戶自己掌控的雲端基礎設施上,而不是 Anthropic 的系統,任何人工審查預設也由客戶自行執行,同時仍維持防範惡意濫用所需的防護能力。EFS 將分階段開放給 Claude Code、Claude Enterprise、Claude Platform、Amazon Bedrock、Claude Platform on AWS、Google Agent Platform 與 Microsoft Foundry,從今年秋季開始推出;在 EFS 正式開放前,符合資格的客戶可先以「零資料留存」(zero data retention)模式使用 Fable 5.1 與 Fable 5。

在資安防護的實際體感上,官方表示 Fable 5.1 的網路安全防護機制誤判率比 Fable 5 上線時降低約 60%,Claude Code 使用者可以感受到明顯較少的防護介入次數;生物領域的防護機制對良性的基礎生物與醫療問題誤判率,也比 Fable 5 剛上線時降低約 85%。不過涉及生命科學研發的查詢仍會被導向 Opus 系列模型,滲透測試、漏洞利用程式撰寫、二進位漏洞掃描等雙用途資安任務也仍會被導向 Opus 系列。

台灣企業導入前,這次更新有哪些新規定要注意(浮水印、反蒸餾機制)

由於 Anthropic 已在 2026 年 7 月與其他 190 家簽署方一同加入歐盟 AI 法案的《AI 生成內容透明度行為準則》,官方規定 2026 年 8 月 2 日後發布的模型輸出內容必須加上浮水印。Fable 5.1 屬於此規定範圍內的模型,其輸出文字含有一種一般使用者看不見、需要透過官方偵測 API 才能判讀的數位浮水印,且該浮水印不含使用者身分或對話內容的任何資訊;官方目前僅先以私人預覽形式,開放偵測 API 給法規要求的特定對象,例如監理機關、執法單位、媒體與查核組織、獨立研究者與教育機構。

另外,官方也加入了新的「反蒸餾」(anti-distillation)機制:從 2026 年 9 月 1 日之後新建立的 API 帳號開始,將無法再手動編輯多輪對話中先前回合的內容、同時保留 Claude 先前的思考記錄文字,藉此堵住一種已被公開紀錄、可用於非法萃取 Claude 思考過程的技術手法。官方表示此變更會逐步推行,現有帳號目前不受影響,但未來新發布的模型將全面適用。台灣企業若計畫用 Fable 5.1 處理內部合規敏感資料,建議在正式導入前先確認上述浮水印與資料留存規則是否符合內部法遵需求。

常見問題 FAQ

Q1:Fable 5.1 和 Fable 5 是同一個模型嗎?跟 Mythos 5.1 又差在哪? Fable 5.1 是 Fable 5 的升級版本,官方視為新一代獨立模型(模型 ID 不同、有專屬的破壞性變更清單),並非單純的參數微調。Mythos 5.1 則與 Fable 5.1 是「同一個底層模型」,差別僅在安全防護層級:Mythos 5.1 針對通過審核的資安與生命科學專業人員,開放較寬鬆的防護限制。

Q2:現在還在用 Fable 5,需要馬上升級到 5.1 嗎? 官方文件列出的三項破壞性變更(不支援強制工具呼叫、思考內容跨模型不可讀、編輯歷史回合會讓思考內容失效)代表升級不是無痛切換,建議先在測試環境驗證你既有的工具呼叫邏輯與多輪對話流程是否受影響,再評估是否要因為快取讀取降價、跑分提升而升級。

Q3:快取讀取降價後,還可以疊加 Batch API 的折扣嗎? 可以。官方定價頁說明 Prompt Caching 的各項倍率會與 Batch API 折扣、資料落地(data residency)加價等其他計價修飾同時疊加計算,彼此不互斥。

Q4:Fable 5.1 的 Context Window 跟 Sonnet 5、Opus 5 一樣大嗎? 一樣。Fable 5.1、Opus 5、Sonnet 5 三款模型都是 100 萬 token 的 Context Window、12.8 萬 token 的最大輸出上限,差別主要在價格、預設思考強度與回應延遲;只有 Haiku 4.5 的規格明顯較小(20 萬 Context Window、6.4 萬最大輸出)。

Q5:Claude Mythos 5.1 一般開發者申請得到嗎? 目前不行。Mythos 5.1 僅透過「Cyber Verification Program」與「Life Sciences Verification Program」兩個信任存取計畫開放,且官方註明目前僅限一部分美國機構,一般開發者與企業帳號無法直接申請使用。

Q6:Fable 5.1 上線後,Sonnet 5 或 Opus 5 的價格會跟著調整嗎? 根據官方定價頁最新公告,原訂 2026 年 9 月 1 日生效的 Sonnet 5 漲價方案(漲到每百萬 3 美元/15 美元)已確定不會執行,Sonnet 5 維持上市時的每百萬 2 美元/10 美元優惠價作為正式牌價;Opus 5(每百萬 5 美元/25 美元)與 Haiku 4.5(每百萬 1 美元/5 美元)目前也沒有變動。

資料來源聲明

本文所有模型規格與定價數字,均查證自 Anthropic 官方發布內容,查證日期為 2026 年 9 月 3 日:

Anthropic 官方公告《Introducing Claude Fable 5.1 and Claude Mythos 5.1》:https://www.anthropic.com/claude-fable-and-mythos-5-1

Claude Platform Docs《Claude Fable 5.1》模型總覽頁:https://platform.claude.com/docs/en/models/fable-5-1/overview

Claude Platform Docs《Pricing》官方定價頁:https://platform.claude.com/docs/en/about-claude/pricing

延伸閱讀

準備好評估 Fable 5.1 是否適合你的團隊了嗎?立即免費試用,用你自己的工作負載實際測算 Token 成本

最新文章

查看全部
DeepSeek V4.1-Flash 上線:官方定價不漲反降,V4-Pro 將被悄悄取代,帳單怎麼跟著變?

DeepSeek 已於 2026 年 9 月 10 日 04:00 UTC 正式推出新一代模型 V4.1-Flash,同步生效的新定價不是漲價,而是比一個月前才調整過的 V4-Flash 價格再往下降:輸出 token 便宜約 9%,快取未命中(cache-miss)輸入 token 便宜約 32%。更關鍵的是,DeepSeek 官方已經宣布從 9 月 14 日中午(北京時間)起,所有打到 dee

 
 
 
SpaceXAI(原xAI)Grok 4.6 API 官方定價全解析:輸出價每M僅$6,比 Claude、GPT-6 便宜多少?

Grok 4.6 的 API 定價是短內容(低於20萬token)輸入每百萬token 2美元、輸出6美元,超過20萬token的長內容則整段請求改按輸入4美元、輸出12美元計費;如果你只看輸出token的價格,Grok 4.6 比 Claude Fable 5.1、GPT-6 Astra 便宜超過八成,是目前主流旗艦模型裡數一數二便宜的選擇。你可能也發現,現在查詢這些資料時,官方文件網域已經不叫

 
 
 
GLM-5.3、Kimi K3 官方定價曝光:除了 DeepSeek,這兩款中國大模型你也該認識

如果你對中國大模型的認識還停留在「DeepSeek 很便宜」,那你可能漏掉了兩個這半年陸續上線、定價同樣壓得很低的競爭者:Zhipu(智譜)旗下的 GLM-5.3,以及 Moonshot AI 的 Kimi K3。GLM-5.3 官方標準定價是每百萬 token 輸入 1.4 美元、輸出 4.4 美元,其中鎖定輕量任務的 GLM-5.3-Flash 目前還在五折優惠期,但優惠將在今天(2026 年

 
 
 

留言


bottom of page