Claude Opus 5 以 Opus 4.8 的訂價(每百萬輸入 5 美元、輸出 25 美元)交付接近 Fable 5 的智能,官方定位為 Fable 5 等級智能的一半成本,Frontier-Bench v0.1 單任務成本比前代更低,並成為 Claude Max 預設模型。

「每任務成本」才是 Opus 5 真正移動的指標

Anthropic 在 7 月 24 日發表 Claude Opus 5,訊號不在「又一款新模型」,而在它把成本結構推去哪裡。Opus 5 每百萬輸入 token 5 美元、每百萬輸出 token 25 美元,與前代 Opus 4.8 完全相同;同時它以約一半的價格,逼近 Claude Fable 5 的前沿智慧。

Fable 5 的美元單價官方並未直接公布,但獨立評測機構 Artificial Analysis 列出 Fable 5 為每百萬 token 10/50 美元——正好是 Opus 5 的兩倍,與官方「半價」的說法一致。換句話說,同一條 agent 迴圈,Opus 5 用 Opus 4.8 的價格,換到接近 Fable 5 的智力。對任何在跑工具呼叫與鏈式推理的人,移動的不是帳面 token 單價,而是每完成一項任務的花費——而這正是 Opus 5 在 Frontier-Bench、CursorBench、OSWorld、AutomationBench 上一再出現更低每任務成本、更高成功率的原因。

訂價與每任務成本:用 Opus 4.8 的錢,買近 Fable 5 的智力

訂價面只有三件事要記住。第一,Opus 5 的 $5/$25 per MTok 與 Opus 4.8 完全相同,沒有漲價也沒有降價。第二,Anthropic 把它定位在約 Fable 5 半價的前沿智慧區間——同一項任務,Opus 5 的每任務成本大約只有 Fable 5 的一半。第三,Fast 模式以約 2.5 倍預設速度運作,價格是基礎價的兩倍,等於用一倍花費換 2.5 倍交付速度,只對延遲敏感、多輪往返會卡住後續工具呼叫的流程划算。

真正會影響採購決策的是「每任務成本」,而它要把單價、成功率與重試次數一起看:一個四次就成功、每次 5 美元的模型,總成本往往低於一個要跑二十次、每次 2 美元才過關的模型。Opus 5 的賣點正是前者——在多數有界任務上,它用更少次數、更低單價完成同樣的工作。

能力與評測:每一條數字背後的每任務效率

Anthropic 在自家評測上把 Opus 5 推到 state-of-the-art,而且幾乎每一條都附帶「每任務成本更低」的註腳:

  • Frontier-Bench v0.1:表現是 Opus 4.8 的兩倍以上,且每任務成本更低,在這項代理編碼評測上超越所有模型。
  • CursorBench 3.2(max effort):最高強度下與 Fable 5 峰值只差 0.5 個百分點,每任務成本卻只有一半;在 high、xhigh、max 三個強度上,它是同價位下表現最好的模型。
  • ARC-AGI 3:測的是面對全新題目的推理力——Opus 5 的得分是次佳模型的三倍。
  • Zapier AutomationBench:衡量模型能否把商務任務從頭做到尾,Opus 5 的通過率大約是次佳模型的 1.5 倍(同一每任務成本下);即便在最低強度,它通過的任務仍比任何對手多。
  • OSWorld 2.0(電腦操作):在任何給定成本上都領先其他模型,並以略高於 Fable 5 最佳結果三分之一的花費超越它。
  • 生命科學:Opus 5 在 Anthropic 每一項內部生命科學評測上都勝過 Opus 4.8,最大增幅在分子結構推斷(+10.2 個百分點)與蛋白質任務(+7.7 個百分點)。

需注意的是,Frontier-Bench、GDPval-AA 與生命科學評測都出自 Anthropic 自家公告與系統卡,CursorBench 則由 IDE 業者 Cursor 主導;在沒有跨廠商同台測試之前,這些 state-of-the-art 成績宜視為廠商定位、而非產業共識。不過獨立評測機構 Artificial Analysis 把 Opus 5 列在其智慧指數第一名(見下文),讓「接近 Fable 5、半價」這組相對關係多了第三方佐證。

Opus 5 vs Opus 4.8 vs Fable 5:第一方比較表

維度Claude Opus 5Claude Opus 4.8Claude Fable 5
每百萬 token 訂價(輸入/輸出)$5/$25$5/$25(與 Opus 5 相同)$10/$50(據 Artificial Analysis;與官方「半價」一致)
Frontier-Bench v0.1表現為 Opus 4.8 兩倍以上、每任務成本更低被超越的基線,並擔任分類器觸發時的退回模型被 Opus 5 超越
CursorBench 3.2(max)與 Fable 5 峰值差 0.5pp,每任務成本僅一半前代,未給特定數字持有峰值,但每任務成本約為 Opus 5 的 2 倍
OSWorld 2.0(電腦操作)任何成本上都領先,以約 Fable 5 三分之一花費超越其最佳結果官方以成本效率定位,未給具體數字前次最佳,被 Opus 5 在約三分之一成本下超越
定位審慎而主動;接近 Fable 5 智慧、Opus 4.8 成本;Max 預設、Pro 最強同價前代;生命科學評測全數落後 Opus 5前沿智慧參考點,Opus 5 以約半價逼近

Opus 5 vs GPT-5.6 Sol vs Fable 5:跨廠商誰贏

跨廠商比較是採購者最常搜尋、卻最難找到可信數字的一塊,因為各廠自報成績無法直接對比。獨立評測聚合 Artificial Analysis 用同一套「Intelligence Index」把不同廠商模型放在同一把尺上,結果對 Opus 5 相當有利:

模型Intelligence Index(越高越好)訂價 in/out (per 1M)Context window
Claude Opus 5(max)61,排行 #1/190$5/$251M
Claude Fable 560,#3/190$10/$501M
GPT-5.6 Sol59,#4/190$5/$301M

幾個可直接引用的結論:Opus 5 在這個中立指數上排第一,領先自家 Fable 5 與 OpenAI 的 GPT-5.6 Sol;它與 GPT-5.6 Sol 輸入單價相同($5),輸出更便宜($25 vs $30),分數卻更高。當然,Intelligence Index 只是眾多方法論之一,側重綜合智力而非單一任務,採購時仍應回到自己的工作負載做評測;但「較便宜的 Opus 5 在中立榜上領先」這個結果,讓它的成本優勢不再只是廠商自說自話。Opus 5 與 GPT-5.6 Sol 的完整逐項對決,見Claude Opus 5 vs GPT-5.6 Sol 比較

適合誰、不適合誰:採購與升級建議

把上面的數字翻成採購語言:Opus 5 是預設值,Fable 5 是例外。

該用 Opus 5 的場景:有界的工程與知識任務——除錯、重構、文件撰寫、資料清理、自動化流程、電腦操作。這些任務的特徵是可驗證、可重試、有明確完成條件,而 Opus 5 在這個區間用更少次數、更低每任務成本完成工作。官方也列舉幾個它主動克服障礙的案例:在沒有檢視工具下,它自己寫出電腦視覺管線、從原始像素重建機械零件;在一個熱門開源套件管理器的真實臭蟲上,它找出根因並補了社群修補漏掉的邊界情形(對手只修了表象);一位交易商工程師用它在單一工作階段把新交易所的行情資料源建起來,前代模型根本做不完——這些都是「一次做完」相對「做不完或反覆重試」的每任務成本勝利。

該考慮 Fable 5 的場景:需要把前沿智力推到極限的長時間、高難度任務,且你願意為那最後一點峰值多付一倍。官方在 CursorBench 與 OSWorld 都標出了交叉點——Opus 5 在多數成本區間領先,Fable 5 只在最高難度的峰值仍佔優。

該留意 Sonnet 5 的場景:大量、低單價、可容忍較低智力的寫作與分類工作;不過這條線的每任務成本數字並未在本次公告中給出,需要另查。更多模型覆蓋見模型分類頁

Claude Opus 5 常見問題:成本、比較、寫程式與升級

Claude Opus 5 是什麼?解決什麼問題?

Claude Opus 5 是 Anthropic 於 2026 年 7 月 24 日發表的 Opus 世代旗艦模型,接續 Opus 4.8,在 Claude 家族中位居 Opus、Sonnet、Haiku 三層的最頂層。官方把它定位為審慎而主動,在程式與知識工作評測(Frontier-Bench、GDPval-AA)上拿下 state-of-the-art,並以約 Fable 5 半價的成本逼近其前沿智慧。它解決的問題很具體:把上一代旗艦的價格,裝進接近前沿的能力裡,讓每一項 agent 任務的花費下降。

Claude Opus 5 何時上線?在哪裡用得到?

Opus 5 已於 7 月 24 日在所有平台同步上線。它是 Claude Max 的新預設模型,也是 Claude Pro 上最強的模型;開發者可透過 Claude API 的模型名稱 claude-opus-5 取用,並提供約 2.5 倍速、雙倍價的 Fast 模式(Claude Platform 與 Claude Code 用量額度內)。官方公告只明確列出 Claude.ai、Claude Code、Claude Cowork 與 Claude API,並未提及 Amazon Bedrock 或 Vertex AI——若需雲端平台通路,請另查官方確認。

Claude Opus 5 多少錢?API 與訂閱怎麼算?

Opus 5 每百萬輸入 token 5 美元、每百萬輸出 token 25 美元,與 Opus 4.8 完全相同;相對於 Fable 5 約為半價(Fable 5 為 $10/$50,據 Artificial Analysis)。Fast 模式為基礎價的兩倍、速度約 2.5 倍。訂閱端,Claude Max 把它設為預設、Claude Pro 把它作為最強模型,兩者依既有方案計費,不再另外加價。

Claude Opus 5 vs Fable 5:哪個比較好?

多數場景下選 Opus 5。在 CursorBench 3.2 最高強度,Opus 5 與 Fable 5 峰值只差 0.5 個百分點,但每任務成本只有一半;在 OSWorld 2.0 它以約 Fable 5 最佳結果三分之一的花費勝出。在 Artificial Analysis 智慧指數上,Opus 5(61)也略高於 Fable 5(60)。Fable 5 仍在最高難度的峰值略佔優——若你的任務需要把前沿智力推到極限、且願意為那一點差距多付一倍,才考慮 Fable 5。換句話說,Opus 5 是預設,Fable 5 是例外。

Claude Opus 5 vs GPT-5.6 Sol:跨廠商誰贏?

據 Artificial Analysis 智慧指數,Opus 5(61,#1)略高於 GPT-5.6 Sol(59,#4);兩者輸入單價同為 $5,但 Opus 5 輸出單價更低($25 vs $30)。要留意這是綜合智力指數,不是單一任務排名,實際表現仍視工作負載而定;但就「同價位、智力更高」這個採購角度,Opus 5 占上風。

Claude Opus 5 vs Opus 4.8:值得升級嗎?

值得,而且幾乎零風險。價格不變($5/$25),API 模型名稱換成 claude-opus-5,表現在 Frontier-Bench v0.1 提升到兩倍以上(每任務成本更低),並在 Anthropic 每一項生命科學評測上都勝過 Opus 4.8(分子結構推斷 +10.2pp、蛋白質任務 +7.7pp)。已經在 Opus 4.8 上的團隊,直接改模型名稱即可享用升級。

Claude Opus 5 寫程式好嗎?比 Opus 4.8 強多少?

寫程式是 Opus 5 升級最明顯的領域。在 Frontier-Bench v0.1,它的表現是 Opus 4.8 的兩倍以上、每任務成本更低;在 CursorBench 3.2 最高強度,它與 Fable 5 峰值只差 0.5pp,但成本只有一半。官方舉的代理案例也偏編碼:它為一個熱門開源套件管理器的真實臭蟲找出根因、補上社群修補漏掉的邊界情形,而對手只修了表象。對在 Claude Code 裡跑 agent 迴圈的團隊,這代表更少重試、更低每任務成本。

Claude Opus 5 的 context window 與規格?

據 Artificial Analysis,Opus 5 的 context window 為 1M tokens,支援文字與圖片輸入、文字輸出。它的智力隨 effort 設定伸縮(low/medium/high/xhigh/max),讓你在智力與成本之間取捨。API 模型名稱為 claude-opus-5,安全細節見系統卡。知識截止日期官方公告未明列,待系統卡或文件確認。

Claude Opus 5 值得買嗎?我該升級嗎?

若你做的是有界的工程或知識工作——寫程式、除錯、自動化、電腦操作——Opus 5 在每任務成本上明顯領先,是同價位最划算的選擇。判斷規則很簡單:任務可驗證、可重試、有明確完成條件,就用 Opus 5;只有當你需要把智力推到極限的長時間任務,才往 Fable 5 升級。從 Opus 4.8 過來的使用者,升級不漲價、表現全面提升,幾乎沒有不升的理由。

Claude Opus 5 安全嗎?為什麼對話中會切換模型?

Anthropic 的自動化行為稽核把 Opus 5 列為迄今對齊度最高的模型——在整體失準行為上得分 2.3(近期模型最低),比 Opus 4.8、Sonnet 5、Fable 5 更遵守 Claude 的憲法,欺騙行為最少、也最難被誘導誤用。它並未推進高風險雙用途能力的前沿:在生物研究與攻擊性網安上仍落後 Mythos 5,在 OSS-Fuzz 上接近 Mythos 5 找漏洞、但把漏洞武器化的能力明顯落後。它的網安分類器比 Fable 5 寬鬆(放行原始碼漏洞檢查、封鎖二進位掃描、滲透測試與攻擊程式產生),預期介入次數比 Fable 5 少約 85%——這也解釋了對話中途切換模型的現象:在 Claude.ai、Claude Code、Claude Cowork 中,被標記的請求會自動退回 Opus 4.8,所以產出可能隨時換到上一代。

安全與定位:Mythos 5 劃出的邊界

Opus 5 不是全面稱王,而是被廠商主動劃出邊界。在網安上,官方刻意不在網安任務上訓練它——它的網安進步來自一般能力提升,而非專門優化。結果是:辨識漏洞的能力接近 Mythos 5,但把漏洞武器化的能力仍明顯落後;生物研究同樣由 Mythos 5 領先。

對評估模型安全的團隊,訊號很清楚:辨識能力與攻擊能力不該混為一談。Opus 5 補上了前者,後者的差距仍在。也正因為它的防護套件與 Opus 4.8 相近,Anthropic 把原本在 Fable 5 上被擋下的生物研究請求,改路由到 Opus 5(而非 Opus 4.8),使它成為目前最強、一般可取得的科研模型。需要更少網安限制的企業與研究人員,則可透過 Cyber Verification Program(CVP)取得放寬版本,現有 CVP 會員可立即使用。此外,與前代 Opus 相同,Opus 5 在一般存取不設資料保留要求。

供應與通路:哪裡用得到、API 怎麼接

通路面一句話總結:所有平台同步上線、Max 預設、Pro 最強。開發者用 claude-opus-5 接 API;Fast 模式在 Claude Platform 與 Claude Code 的用量額度內提供;CVP 會員可立即取得網安限制較少的版本。官方公告只明確列出 Claude.ai、Claude Code、Claude Cowork 與 Claude API——其他雲端通路需另查官方。

把整件事拉回成本主軸:Anthropic 沒有降價,而是把上一代旗艦的價格,裝進接近 Fable 5 的能力裡。每任務成本這個指標,在這一代正式往前走了一步。若只想先掌握發表重點與官方定位,可先讀Claude Opus 5 發布摘要