Claude Opus 5 是什麼?能力、定價與 Opus 4.8/Fable 5 差異
2026 年 7 月 24 日,Anthropic 發布 Claude Opus 5,定價與前代 Opus 4.8 相同,在 Artificial Analysis 基準測試排行榜上超越 Claude Fable 5
目錄

重點摘要
- 2026 年 7 月 24 日,Anthropic 發布 Claude Opus 5,定價與前代 Opus 4.8 相同,在 Artificial Analysis 基準測試排行榜上超越 Claude Fable 5
- 在一項刻意封鎖圖片檢視許可權的 FreeCAD 任務中,Opus 5 自行撰寫電腦視覺管線,從原始畫素反推幾何,完成 3D 零件重建
- Opus 5 偵測資安漏洞的能力已逼近 Mythos 5,但將漏洞轉為實際攻擊的利用能力仍明顯落後,Anthropic 指出這是刻意訓練選擇
2026 年 7 月 24 日,Anthropic 正式發布 Claude Opus 5,定位是「思慮周全、主動積極的模型」,能力逼近 Claude Fable 5,定價則與上代 Opus 4.8 持平,並延續快速模式選項(費用為基本定價的兩倍)。上線後在 Artificial Analysis 基準測試排行榜上,Opus 5 的得分已超越 Fable 5,暫居榜首。相較於榜首名次,更具指標意義的是兩個訊號:這個模型主動到什麼程度,以及 Anthropic 在資安能力上畫了哪條線、又為什麼這樣畫。
Claude Opus 5 的發布揭示了 AI 從「被動執行」跨向「主動建構工具」的範式轉移,同時也展現了 Anthropic 在通用能力躍升下,試圖在資安防禦與攻擊武器化之間維持的刻意留白。
Opus 5 的 FreeCAD 任務,說明瞭什麼?
Anthropic 在發布貼文中描述了一個 Frontier-Bench 任務案例。任務本身不複雜:給模型一張機械零件工程圖,要它寫程式重建為 3D FreeCAD 模型。難的是刻意設計的限制,模型沒有任何方法直接「看」那張圖。
過去的模型遇到這種狀況,通常是報錯或要求補上缺少的工具。Opus 5 的反應不同,它自己撰寫了一條電腦視覺管線,從原始畫素裡解析幾何資訊,再重建出完整零件。
這個案例代表能力邊界正在移動。過去衡量大型語言模型主要看「答得好不好」,Opus 5 則展現了另一種做法:當現有工具不夠用,模型會主動補上工具鏈。從「等待分配任務」到「主動消除任務阻礙」,兩者的行為模式差距不小,而且這個差距對下游的代理人系統設計影響很直接。
開發 AI 代理人系統的工程師必須注意這個轉變。 模型的主動性一旦達到這個程度,「沒給工具就不會做」的隱性邊界假設就會變得不可靠,尤其是在有外部 API 呼叫或系統寫入許可權的代理人環境裡。模型有可能在你設定的工具框架之外,自行衍生出你沒預想到的行為路徑。
「找得到、打不穿」:Anthropic 的資安定位是刻意的嗎?
Anthropic 在這一點說得很直接:Opus 5 刻意沒有針對網路安全任務做訓練,但通用能力的提升還是帶動了資安表現。具體結果是,Opus 5 在「找出漏洞」這個維度上已逼近 Mythos 5(一款以網路安全任務為核心的模型),但在「把漏洞轉成實際攻擊手段」這個維度上,仍明顯落後。
Anthropic 用的詞是「刻意避免」,而非「技術尚未企及」。這是 Anthropic 的主動選擇,而不是技術跟不上。
背後的設計邏輯看起來是: 漏洞偵測對防禦方有正當用途;漏洞利用的危險面積更大,更難管控,所以訓練時在這兩者之間畫了一條線。這條線目前能守住,但這次網路安全表現的意外提升正好說明瞭問題所在:Anthropic 沒有主動訓練,能力卻還是跟著跑上來了一截。當下一代模型的通用能力繼續往前走,這條線還能不能守得住,比「找不找得到漏洞」更值得關注。
Anthropic 在發布貼文裡主動說明這個設計選擇,語氣頗為清楚,推測也有向外部監管方示意的考量:我們知道自己在做什麼,也知道我們選擇不做什麼。這種主動揭露的做法,本身就是一種表態。
開發者可以拿 Opus 5 做什麼、不該期待什麼?
工具設計上,Anthropic 另外發布了 Claude Opus 5 的提示工程指南,可以作為調整系統提示詞的參考起點。但更根本的問題是,主動性更強的模型要求更明確的授權邊界:在工具綱要裡說清楚模型能做什麼、不能做什麼,而不是靠「沒給工具就不會做」的隱性假設來做安全緩衝。
在資安評估方面,Opus 5 的偵測能力對紅隊演練與漏洞掃描輔助是個好訊息:覆蓋率拉高了,而且這個提升來自通用能力,而非網路安全專項訓練。這意味著它能找到你沒預期到的問題。但漏洞利用的刻意留白代表它不會自動接手從漏洞到攻擊的完整鏈條,這個邊界目前是清楚的。
Opus 5 的故事核心是:能力邊界正在從「答得好」移向「主動行動」,而這個移動讓過去隱藏在代理人設計裡的假設一一浮出水面。Anthropic 在漏洞利用上刻意留空,是目前看得見的安全設計;但留空能否跟上通用能力的每次提升,才是接下來真正值得追問的問題。
標籤


