Claude Opus 5 是什麼?用一半價格逼近 Fable 5,還揭露了 Mythos 分流機制的新細節

Anthropic 在 2026 年 7 月 24 日發布了 Claude Opus 5,官方對它的定位很直白:在許多任務上逼近旗艦模型 Fable 5 的智慧水準,價格卻只要一半。如果你還記得我們先前介紹過 Claude Fable 5 那套「安全分流機制」——高風險請求會被自動轉導到 Opus 4.8——這篇文章要告訴你一個新細節:這套分流規則,隨著 Opus 5 上線又更新了一次。
Opus 5 跟 Opus 4.8 差在哪?價格沒變,能力大幅跳級
先講最直接的重點:Opus 5 的定價跟前一代 Opus 4.8 完全相同,每百萬輸入 Token 5 美元、每百萬輸出 Token 25 美元,另外提供 Fast 模式,價格是基礎價的兩倍。Anthropic 官方的說法是,Opus 5「用跟前代相同的成本,提供大幅提升的效能」。換句話說,這次升級不是把價格墊高換取更強能力,而是同樣的預算,直接換到更好的模型。
目前 Opus 5 已經是 Claude Max 方案的預設模型,也是 Claude Pro 方案中能力最強的選項,同時開放 API 呼叫(模型代號 `claude-opus-5`),也整合進 Claude.ai、Claude Code、Claude Cowork 這幾個產品線。
官方點名的 benchmark:涵蓋程式、知識工作、視覺輸出
Anthropic 這次發布提到的評測基準相當多元,包括 Frontier-Bench、CursorBench 3.2、ARC-AGI 3、Zapier AutomationBench、OSWorld 2.0、GDPval-AA,以及專門測資安漏洞挖掘與利用能力的 OSS-Fuzz。官方特別強調 Opus 5 在驗證與反覆解題(iterative problem-solving)上更強,尤其擅長軟體工程與知識工作類任務,視覺輸出品質也有提升。
「仍落後於 Mythos 5」是什麼意思?先搞懂 Mythos 到底是誰
官方發布頁裡有一句話很值得放大看:Opus 5 在多數評測上已經是新的公開版本天花板,但「仍落後於 Mythos 5」,落後的範圍集中在資安攻防與生物研究這兩個特定領域。你可能會想,Mythos 5 又是誰?我們查了 Anthropic 官方的模型介紹頁,答案其實比想像中單純——Mythos 5 跟 Fable 5 是同一個底層模型,差別在於 Fable 5 是加上完整安全防護層之後的公開版本,Mythos 5 則是拿掉這層防護、能力沒被限縮的版本,目前只開放給一小群測試夥伴做資安研究用途(官方表示生物研究方向的開放也即將到來),並非一般使用者可以申請的產品。
這個設計邏輯跟我們先前介紹 Fable 5 時提到的「安全分流機制」是同一套思路的延續:同一種找漏洞的能力,公開版本要先過濾掉會被拿去做壞事的那一部分。Anthropic 自己的說法很直接——Mythos 5「因為在資安與生物研究上能力太強,可能被用於善意或惡意用途」,所以目前只透過信任存取計畫,開放給一小群、但持續在成長的客戶。
那 Opus 5 跟 Mythos 5 的差距具體有多大?根據官方揭露的 OSS-Fuzz 測試結果,Opus 5「找出」資安漏洞的能力已經很接近 Mythos 5,但把漏洞真正「開發成可用的攻擊手法」這一步,Opus 5 明顯落後 Mythos 5 不少。Anthropic 說明這是刻意的訓練選擇——他們跟 Opus 4.8 一樣,刻意不讓 Opus 5 針對資安攻擊任務去訓練,這個能力提升純粹是模型整體變聰明之後的副產品,而不是刻意鍛鍊出來的。生物研究領域也是類似情況:官方表示 Opus 5 在長時間、自主運作的研究任務上仍有明顯限制,而這正是他們認為 AI 模型最可能帶來生物風險的地方,「Mythos 5 在這類生物研究工作上仍是更強的模型」。
一個延續前作的關鍵細節:分流路由規則又更新了,而且是兩條規則同時在動
如果你看過我們先前那篇 Fable 5 的文章,應該記得裡面提到的分流機制——高風險請求會從 Fable 5 被轉導到 Opus 4.8。這次 Opus 5 發布,官方揭露的路由規則其實有兩條,方向還不一樣,這裡要分開講清楚,避免混為一談。
第一條,是 Opus 5 自己內建的資安分類器。官方說明 Opus 5 的資安分類器,比 Fable 5 上的同類機制「比例上更寬鬆」——允許 Opus 5 在原始碼中找漏洞,但仍然擋下「以二進位檔為基礎」的漏洞掃描(官方說這種方法比較常跟惡意行為者連結在一起)、滲透測試,以及漏洞利用開發。根據 Anthropic 自己的測試,他們預期這套分類器出手攔截的頻率,會比 Fable 5 上的同類機制少大約 85%。但重點來了:在 Claude.ai、Claude Code、Claude Cowork 這幾個產品裡,只要請求被標記攔截,預設就會轉回 Opus 4.8;API 端也可以另外啟用同樣的回退機制。如果你的團隊本來就是通過驗證的資安研究單位,官方另外設有一個叫「Cyber Verification Program(CVP)」的管道,已加入的企業跟研究人員可以直接拿到限制較少的 Opus 5 版本。
第二條,才是生物相關請求的規則:原本在 Fable 5 上被擋下的生物相關請求,現在會轉導到 Opus 5,而不是原本的 Opus 4.8。原因是 Opus 5 的生物安全防護跟 Opus 4.8 相近,讓它成為目前公開版本中最適合做科學研究的模型,所以官方把這條回退路徑從 Opus 4.8 升級指向 Opus 5。
你會發現,這兩條規則的方向剛好相反——資安被攔截的請求「退回」Opus 4.8,生物相關被攔截的請求「升級」到 Opus 5。這對已經串接 Claude API 的開發者跟企業用戶來說,值得放進監控清單,而不是單純假設「反正都轉到某一顆模型」。我們在 Fable 5 那篇文章提醒過的重點,這裡再強調一次:不要只看帳單總額,最好能記錄實際處理你請求的模型版本,才不會在預算估算或效能監控上抓錯重點。這部分屬於我們根據官方揭露規則做的實務提醒,並非 Anthropic 官方要求的操作流程。
對齊表現:官方自稱是「最不會說謊」的一代
除了效能與安全分流之外,官方也揭露了一項對齊(alignment)數據:在自動化行為稽核中,Opus 5 在整體不當行為(misaligned behavior)的得分是 2.3,是 Anthropic 近期模型中最低的一個,官方形容這是他們對齊程度最高、欺騙行為比例最低的模型。這項數字本身是 Anthropic 自行揭露、自行評測的結果,我們沒有第三方數據可以交叉驗證,這裡如實呈現官方說法,不做額外背書或延伸解讀。
對企業採購跟 Token 預算規劃的實務意義
把前面幾個重點串起來看,Opus 5 對正在做模型選型或採購評估的企業,至少有三個實際影響值得留意。
第一,如果你原本因為預算考量,把重要任務留給 Fable 5、次要任務交給 Opus 4.8,現在 Opus 5 用相同價格提供更強能力,這個分工比例值得重新盤點,說不定有一部分原本要用 Fable 5 才能做到的任務,現在用 Opus 5 就夠了,能省下一截成本。
第二,安全分流規則不是一次性設定,而是會隨著新模型上線持續調整——這次是生物相關的分流從 Opus 4.8 換成 Opus 5,未來不無可能再次更新。如果你的產品場景踩在敏感內容邊緣,建議把「定期核對官方分流規則是否更新」納入例行維護項目,而不是設定一次就當作永久不變。
第三,Mythos 5 這個受限存取的頂層模型,目前一般企業申請不到,但它的存在本身是一個訊號:模型能力天花板跟「一般人能拿到的能力」之間,本來就存在一段刻意留出的安全緩衝。評估供應商的時候,與其只問「你們最強的模型是什麼」,不如多問一句「我能拿到的版本,跟你們技術上做得到的版本,差距在哪裡」,這對評估風險邊界會更實際。
FAQ
Q1:Claude Opus 5 跟 Claude Fable 5 該怎麼選?
如果預算有限、任務又不到需要 Fable 5 頂規能力的程度,Opus 5 用一半價格逼近 Fable 5 的表現,會是更划算的選擇;如果任務對能力要求極高、預算允許,Fable 5 仍是目前公開版本中能力上限最高的選項。實務上建議用自己的任務去實測比較,而不是只看官方 benchmark 數字。
Q2:Mythos 5 一般人可以申請使用嗎?
目前不行。根據 Anthropic 官方說明,Mythos 5 只透過信任存取計畫開放給一小群測試夥伴做資安研究(生物研究方向即將開放),並非一般使用者或企業可以直接申請的公開產品。
Q3:Opus 5 的定價會比 Opus 4.8 貴嗎?
不會,官方說明兩者定價完全相同,每百萬輸入 Token 5 美元、每百萬輸出 Token 25 美元,Fast 模式為基礎價的兩倍,這部分沒有調漲。
Q4:我的應用如果涉及生物或資安相關內容,需要注意什麼?
官方這次更新了兩條方向不同的路由規則:原本在 Fable 5 上被擋下的生物相關請求,現在會轉導到 Opus 5(而非原本的 Opus 4.8);但 Opus 5 自己內建的資安分類器一旦攔截請求,在 Claude.ai、Claude Code、Claude Cowork 上預設會退回 Opus 4.8。如果你的產品場景踩在這類邊緣,建議記錄實際處理請求的模型版本,並定期核對官方最新的分流規則,不要假設所有被攔截的請求都會落在同一顆模型上。
Q5:Opus 5 的「對齊分數」數字可以直接採信嗎?
這是 Anthropic 官方自行進行的自動化行為稽核結果,屬於官方一手揭露的數據,我們沒有第三方數據可以交叉驗證,建議將它視為官方說法而非獨立驗證過的結論。
資料來源聲明
本文選題觸發來源為 YouTube 影片《Claude Opus 5 in 8 Minutes》(頻道:Developers Digest,發布時間約在 Anthropic 官方公告後數日內)。Copywriter 本人並未觀看該影片、亦未取得其逐字稿,因此本文不含任何對影片畫面或話術的轉述。本次選題也未使用 Apify streamers/youtube-scraper 抓取精確觀看數(本 session 無 APIFY_TOKEN 可用),觀看數欄位如實留空,未以估計值充數。本文全部具體事實——定價、可用性、benchmark 名稱、Mythos/Fable 關係、路由規則更新、對齊分數——均直接查證自 Anthropic 官方發布頁(anthropic.com/news/claude-opus-5)與官方模型介紹頁(anthropic.com/claude/mythos),以 curl 調閱兩頁完整原始 HTML 逐項核對,非依賴影片內容或任何二手轉述。
延伸閱讀
立即行動
如果你正在評估要不要把 Opus 4.8 換成 Opus 5、或是重新分配 Fable 5 與 Opus 系列的任務分工,歡迎免費試用 AI Token King,讓我們幫你把不同模型的實際 Token 用量與成本攤開來看,用數字決定選型,而不是只看官方行銷說法。

留言