top of page

Claude Opus 5 是什麼?用一半價格逼近 Fable 5,還揭露了 Mythos 分流機制的新細節

7月30日
讀畢需時 7 分鐘
Isometric illustration representing Claude Opus 5 and Mythos model tiers

Anthropic 在 2026 年 7 月 24 日發布了 Claude Opus 5,官方對它的定位很直白:在許多任務上逼近旗艦模型 Fable 5 的智慧水準,價格卻只要一半。如果你還記得我們先前介紹過 Claude Fable 5 那套「安全分流機制」——高風險請求會被自動轉導到 Opus 4.8——這篇文章要告訴你一個新細節:這套分流規則,隨著 Opus 5 上線又更新了一次。

Opus 5 跟 Opus 4.8 差在哪?價格沒變,能力大幅跳級

先講最直接的重點:Opus 5 的定價跟前一代 Opus 4.8 完全相同,每百萬輸入 Token 5 美元、每百萬輸出 Token 25 美元,另外提供 Fast 模式,價格是基礎價的兩倍。Anthropic 官方的說法是,Opus 5「用跟前代相同的成本,提供大幅提升的效能」。換句話說,這次升級不是把價格墊高換取更強能力,而是同樣的預算,直接換到更好的模型。

目前 Opus 5 已經是 Claude Max 方案的預設模型,也是 Claude Pro 方案中能力最強的選項,同時開放 API 呼叫(模型代號 `claude-opus-5`),也整合進 Claude.ai、Claude Code、Claude Cowork 這幾個產品線。

官方點名的 benchmark:涵蓋程式、知識工作、視覺輸出

Anthropic 這次發布提到的評測基準相當多元,包括 Frontier-Bench、CursorBench 3.2、ARC-AGI 3、Zapier AutomationBench、OSWorld 2.0、GDPval-AA,以及專門測資安漏洞挖掘與利用能力的 OSS-Fuzz。官方特別強調 Opus 5 在驗證與反覆解題(iterative problem-solving)上更強,尤其擅長軟體工程與知識工作類任務,視覺輸出品質也有提升。

「仍落後於 Mythos 5」是什麼意思?先搞懂 Mythos 到底是誰

官方發布頁裡有一句話很值得放大看:Opus 5 在多數評測上已經是新的公開版本天花板,但「仍落後於 Mythos 5」,落後的範圍集中在資安攻防與生物研究這兩個特定領域。你可能會想,Mythos 5 又是誰?我們查了 Anthropic 官方的模型介紹頁,答案其實比想像中單純——Mythos 5 跟 Fable 5 是同一個底層模型,差別在於 Fable 5 是加上完整安全防護層之後的公開版本,Mythos 5 則是拿掉這層防護、能力沒被限縮的版本,目前只開放給一小群測試夥伴做資安研究用途(官方表示生物研究方向的開放也即將到來),並非一般使用者可以申請的產品。

這個設計邏輯跟我們先前介紹 Fable 5 時提到的「安全分流機制」是同一套思路的延續:同一種找漏洞的能力,公開版本要先過濾掉會被拿去做壞事的那一部分。Anthropic 自己的說法很直接——Mythos 5「因為在資安與生物研究上能力太強,可能被用於善意或惡意用途」,所以目前只透過信任存取計畫,開放給一小群、但持續在成長的客戶。

那 Opus 5 跟 Mythos 5 的差距具體有多大?根據官方揭露的 OSS-Fuzz 測試結果,Opus 5「找出」資安漏洞的能力已經很接近 Mythos 5,但把漏洞真正「開發成可用的攻擊手法」這一步,Opus 5 明顯落後 Mythos 5 不少。Anthropic 說明這是刻意的訓練選擇——他們跟 Opus 4.8 一樣,刻意不讓 Opus 5 針對資安攻擊任務去訓練,這個能力提升純粹是模型整體變聰明之後的副產品,而不是刻意鍛鍊出來的。生物研究領域也是類似情況:官方表示 Opus 5 在長時間、自主運作的研究任務上仍有明顯限制,而這正是他們認為 AI 模型最可能帶來生物風險的地方,「Mythos 5 在這類生物研究工作上仍是更強的模型」。

一個延續前作的關鍵細節:分流路由規則又更新了,而且是兩條規則同時在動

如果你看過我們先前那篇 Fable 5 的文章,應該記得裡面提到的分流機制——高風險請求會從 Fable 5 被轉導到 Opus 4.8。這次 Opus 5 發布,官方揭露的路由規則其實有兩條,方向還不一樣,這裡要分開講清楚,避免混為一談。

第一條,是 Opus 5 自己內建的資安分類器。官方說明 Opus 5 的資安分類器,比 Fable 5 上的同類機制「比例上更寬鬆」——允許 Opus 5 在原始碼中找漏洞,但仍然擋下「以二進位檔為基礎」的漏洞掃描(官方說這種方法比較常跟惡意行為者連結在一起)、滲透測試,以及漏洞利用開發。根據 Anthropic 自己的測試,他們預期這套分類器出手攔截的頻率,會比 Fable 5 上的同類機制少大約 85%。但重點來了:在 Claude.ai、Claude Code、Claude Cowork 這幾個產品裡,只要請求被標記攔截,預設就會轉回 Opus 4.8;API 端也可以另外啟用同樣的回退機制。如果你的團隊本來就是通過驗證的資安研究單位,官方另外設有一個叫「Cyber Verification Program(CVP)」的管道,已加入的企業跟研究人員可以直接拿到限制較少的 Opus 5 版本。

第二條,才是生物相關請求的規則:原本在 Fable 5 上被擋下的生物相關請求,現在會轉導到 Opus 5,而不是原本的 Opus 4.8。原因是 Opus 5 的生物安全防護跟 Opus 4.8 相近,讓它成為目前公開版本中最適合做科學研究的模型,所以官方把這條回退路徑從 Opus 4.8 升級指向 Opus 5。

你會發現,這兩條規則的方向剛好相反——資安被攔截的請求「退回」Opus 4.8,生物相關被攔截的請求「升級」到 Opus 5。這對已經串接 Claude API 的開發者跟企業用戶來說,值得放進監控清單,而不是單純假設「反正都轉到某一顆模型」。我們在 Fable 5 那篇文章提醒過的重點,這裡再強調一次:不要只看帳單總額,最好能記錄實際處理你請求的模型版本,才不會在預算估算或效能監控上抓錯重點。這部分屬於我們根據官方揭露規則做的實務提醒,並非 Anthropic 官方要求的操作流程。

對齊表現:官方自稱是「最不會說謊」的一代

除了效能與安全分流之外,官方也揭露了一項對齊(alignment)數據:在自動化行為稽核中,Opus 5 在整體不當行為(misaligned behavior)的得分是 2.3,是 Anthropic 近期模型中最低的一個,官方形容這是他們對齊程度最高、欺騙行為比例最低的模型。這項數字本身是 Anthropic 自行揭露、自行評測的結果,我們沒有第三方數據可以交叉驗證,這裡如實呈現官方說法,不做額外背書或延伸解讀。

對企業採購跟 Token 預算規劃的實務意義

把前面幾個重點串起來看,Opus 5 對正在做模型選型或採購評估的企業,至少有三個實際影響值得留意。

第一,如果你原本因為預算考量,把重要任務留給 Fable 5、次要任務交給 Opus 4.8,現在 Opus 5 用相同價格提供更強能力,這個分工比例值得重新盤點,說不定有一部分原本要用 Fable 5 才能做到的任務,現在用 Opus 5 就夠了,能省下一截成本。

第二,安全分流規則不是一次性設定,而是會隨著新模型上線持續調整——這次是生物相關的分流從 Opus 4.8 換成 Opus 5,未來不無可能再次更新。如果你的產品場景踩在敏感內容邊緣,建議把「定期核對官方分流規則是否更新」納入例行維護項目,而不是設定一次就當作永久不變。

第三,Mythos 5 這個受限存取的頂層模型,目前一般企業申請不到,但它的存在本身是一個訊號:模型能力天花板跟「一般人能拿到的能力」之間,本來就存在一段刻意留出的安全緩衝。評估供應商的時候,與其只問「你們最強的模型是什麼」,不如多問一句「我能拿到的版本,跟你們技術上做得到的版本,差距在哪裡」,這對評估風險邊界會更實際。

FAQ

Q1:Claude Opus 5 跟 Claude Fable 5 該怎麼選?

如果預算有限、任務又不到需要 Fable 5 頂規能力的程度,Opus 5 用一半價格逼近 Fable 5 的表現,會是更划算的選擇;如果任務對能力要求極高、預算允許,Fable 5 仍是目前公開版本中能力上限最高的選項。實務上建議用自己的任務去實測比較,而不是只看官方 benchmark 數字。

Q2:Mythos 5 一般人可以申請使用嗎?

目前不行。根據 Anthropic 官方說明,Mythos 5 只透過信任存取計畫開放給一小群測試夥伴做資安研究(生物研究方向即將開放),並非一般使用者或企業可以直接申請的公開產品。

Q3:Opus 5 的定價會比 Opus 4.8 貴嗎?

不會,官方說明兩者定價完全相同,每百萬輸入 Token 5 美元、每百萬輸出 Token 25 美元,Fast 模式為基礎價的兩倍,這部分沒有調漲。

Q4:我的應用如果涉及生物或資安相關內容,需要注意什麼?

官方這次更新了兩條方向不同的路由規則:原本在 Fable 5 上被擋下的生物相關請求,現在會轉導到 Opus 5(而非原本的 Opus 4.8);但 Opus 5 自己內建的資安分類器一旦攔截請求,在 Claude.ai、Claude Code、Claude Cowork 上預設會退回 Opus 4.8。如果你的產品場景踩在這類邊緣,建議記錄實際處理請求的模型版本,並定期核對官方最新的分流規則,不要假設所有被攔截的請求都會落在同一顆模型上。

Q5:Opus 5 的「對齊分數」數字可以直接採信嗎?

這是 Anthropic 官方自行進行的自動化行為稽核結果,屬於官方一手揭露的數據,我們沒有第三方數據可以交叉驗證,建議將它視為官方說法而非獨立驗證過的結論。

資料來源聲明

本文選題觸發來源為 YouTube 影片《Claude Opus 5 in 8 Minutes》(頻道:Developers Digest,發布時間約在 Anthropic 官方公告後數日內)。Copywriter 本人並未觀看該影片、亦未取得其逐字稿,因此本文不含任何對影片畫面或話術的轉述。本次選題也未使用 Apify streamers/youtube-scraper 抓取精確觀看數(本 session 無 APIFY_TOKEN 可用),觀看數欄位如實留空,未以估計值充數。本文全部具體事實——定價、可用性、benchmark 名稱、Mythos/Fable 關係、路由規則更新、對齊分數——均直接查證自 Anthropic 官方發布頁(anthropic.com/news/claude-opus-5)與官方模型介紹頁(anthropic.com/claude/mythos),以 curl 調閱兩頁完整原始 HTML 逐項核對,非依賴影片內容或任何二手轉述。

延伸閱讀

立即行動

如果你正在評估要不要把 Opus 4.8 換成 Opus 5、或是重新分配 Fable 5 與 Opus 系列的任務分工,歡迎免費試用 AI Token King,讓我們幫你把不同模型的實際 Token 用量與成本攤開來看,用數字決定選型,而不是只看官方行銷說法。

最新文章

查看全部
DeepSeek V4.1-Flash 上線:官方定價不漲反降,V4-Pro 將被悄悄取代,帳單怎麼跟著變?

DeepSeek 已於 2026 年 9 月 10 日 04:00 UTC 正式推出新一代模型 V4.1-Flash,同步生效的新定價不是漲價,而是比一個月前才調整過的 V4-Flash 價格再往下降:輸出 token 便宜約 9%,快取未命中(cache-miss)輸入 token 便宜約 32%。更關鍵的是,DeepSeek 官方已經宣布從 9 月 14 日中午(北京時間)起,所有打到 dee

 
 
 
SpaceXAI(原xAI)Grok 4.6 API 官方定價全解析:輸出價每M僅$6,比 Claude、GPT-6 便宜多少?

Grok 4.6 的 API 定價是短內容(低於20萬token)輸入每百萬token 2美元、輸出6美元,超過20萬token的長內容則整段請求改按輸入4美元、輸出12美元計費;如果你只看輸出token的價格,Grok 4.6 比 Claude Fable 5.1、GPT-6 Astra 便宜超過八成,是目前主流旗艦模型裡數一數二便宜的選擇。你可能也發現,現在查詢這些資料時,官方文件網域已經不叫

 
 
 
GLM-5.3、Kimi K3 官方定價曝光:除了 DeepSeek,這兩款中國大模型你也該認識

如果你對中國大模型的認識還停留在「DeepSeek 很便宜」,那你可能漏掉了兩個這半年陸續上線、定價同樣壓得很低的競爭者:Zhipu(智譜)旗下的 GLM-5.3,以及 Moonshot AI 的 Kimi K3。GLM-5.3 官方標準定價是每百萬 token 輸入 1.4 美元、輸出 4.4 美元,其中鎖定輕量任務的 GLM-5.3-Flash 目前還在五折優惠期,但優惠將在今天(2026 年

 
 
 

留言


bottom of page