Claude Opus 5 發表!和 Fable 5 差在哪?功能、價格與評價一次看

Anthropic 推出 Claude Opus 5,官方強調以一半價格逼近旗艦模型 Claude Fable 5 的表現,並成為 Claude Max 預設模型。價格與前代 Opus 4.8 相同,主打長時程 AI Agent、Coding 與知識工作。

Introducing Claude Opus 5

📌 重點整理

  • Anthropic 於 2026 年 7 月 24 日推出 Claude Opus 5,並設為 Claude Max 預設模型。
  • API 價格維持與 Opus 4.8 一樣 :輸入 US$5、輸出 US$25/百萬 Token。
  • 核心升級聚焦 Coding、Debugging、長時間 Agent、多步驟工具操作與 Computer Use。
  • Opus 5 強化自我檢查、修正與驗證能力,提升長流程任務的穩定性與完成率。
  • 相較 Fable 5,Opus 5 以約一半 API 價格提供接近的整體效能,部分任務成本效率更高。
  • 企業實測顯示,Zapier、Lovable、Box 均回報任務完成率、穩定性或 Token 效率提升。
  • 模型選擇上,Sonnet 5 適合高頻率日常任務、Opus 5 適合進階專業工作,Fable 5/Mythos 5 則偏向更高難度與前沿研究場景。

Claude Opus 5 是什麼?解決什麼問題

Claude Opus 5 是 Anthropic Claude Opus 系列的新一代模型,主打高強度推理、長時間任務與工具操作,並被設為 Claude Max 預設模型。官方特別強調 Coding、Debugging、大型程式碼庫修改、AI Agent、多步驟自動化、財務與法律分析、科學研究、Computer Use,以及視覺化與 Artifact 製作等專業場景。

這次升級核心聚焦在「長流程任務的穩定性」。Opus 5 會更頻繁檢查工作結果,遇到問題時持續測試、修正與重新驗證,降低長流程跑偏、輸出品質不穩與 Token 消耗過高等問題。對需要長時間運作的 AI Agent、跨多檔案開發、財務模型或反覆修改內容等任務來說,這也是 Opus 5 最值得關注的改進。

Claude Opus 5 有哪些升級?

1. Coding 能力提升,更會自己找方法解題

Coding 仍是 Claude Opus 5 最明顯的升級方向。Anthropic 表示,Opus 5 在軟體工程評測 Frontier-Bench v0.1 中拿下領先成績,相較 Opus 4.8,任務完成表現提升超過一倍,同時降低單次任務成本。

Frontier Bench
Frontier-Bench

更值得注意的是它處理「沒有現成解法」問題的能力。在一項 Frontier-Bench 任務中,模型無法直接讀取機械零件工程圖,Opus 5 便自行建立電腦視覺流程,從原始像素擷取幾何資訊,再重建成 3D FreeCAD 模型,而且能重複成功完成。

這類能力也延伸至 Debugging、大型 Codebase 修改、跨檔案開發、Code Review 與測試驗證等複雜工程任務。

2. 更擅長找出 Bug 根因,而非只修表面問題

Anthropic 表示,Opus 5 在 Debugging 與根因分析能力上進一步提升,能更精準定位問題來源、驗證修正結果,並處理容易被忽略的邊界情況。這讓模型在大型程式碼庫維護、複雜除錯與長時間 Agentic Coding 等任務中,具備更完整的問題分析與修正能力。

3. AI Agent 自主性提高,缺工具時會自己補上

Opus 5 強化了長時間、多步驟任務的執行能力。模型會主動檢查輸出、發現問題並重新測試,降低 Agent 在流程中途偏離目標的機率。

例如某交易公司工程師使用 Opus 5 串接新交易所行情資料時,由於缺乏可直接比對的即時資料,模型自行建立測試框架,驗證程式是否能正確解析交易所資料格式,並在單一工作階段內完成整套串接。

Automationbench
AutomationBench

在 Zapier AutomationBench 中,Opus 5 在相同任務成本下,通過率約為次佳模型的 1.5 倍,也顯示其在企業自動化與工具調用上的進步。

4. Computer Use 與電腦操作能力提升

在 OSWorld 2.0 電腦操作評測中,Opus 5 在不同成本區間均取得領先表現。官方數據顯示,Opus 5 約使用 Fable 5 三分之一多的成本,就能超越後者的最佳成績。

這項能力讓模型更適合處理瀏覽器操作、軟體使用、資料輸入、網頁研究與跨工具工作流程,也是 AI Agent 從文字生成走向實際執行任務的重要能力。

5. 面對陌生問題的推理能力更強

在 ARC-AGI 3 評測中,Opus 5 的成績達到次佳模型約 3 倍。

Arc Agi 3
ARC-AGI 3

ARC-AGI 3 主要測試模型面對全新規則與陌生問題時,能否自行推導解法,因此更能反映模型的抽象推理、歸納與問題解決能力。

6. 科學與生命科學研究能力進步

Anthropic 也強化 Opus 5 在科學研究場景的表現,涵蓋結構生物學、有機化學與生物資訊學。

官方測試顯示,Opus 5 在根據光譜資料推測分子結構的任務中,比 Opus 4.8 高出 10.2 個百分點;在預測蛋白質序列變異對功能影響的測試中,也高出 7.7 個百分點。

Anthropic 因此將 Opus 5 定位為目前旗下通用模型中,科學研究能力最強的一款。

Claude Opus 5 vs Fable 5 差在哪?

項目Claude Opus 5Claude Fable 5
發布日期2026/07/242026/06/09
層級Opus 級,日常主力Mythos 級,最高階公開模型
API 輸入 / 輸出價格
(每百萬 Token)
$5/$25$10/$50
相對成本基準約 2 倍
訂閱方案・Claude Max 預設
・Claude Pro 最強
依 Anthropic 當期方案規則
核心強項・資料搜尋
・電腦操作
・文件與流程處理
・高難度推理
・長時程自主任務
相對弱項超長篇推理、資安題目略遜綜合表現已被 Opus 5 追上
拒答傾向誤判率明顯較低較嚴格
觸發限制時幾乎不會發生自動轉由其他模型回應,並主動告知
對話留存無強制留存保留 30 天供安全審查,不可關閉
回應節奏思考深度可調,可優先求快深度思考恆常開啟,速度較慢
適用對象一般用戶與多數日常工作容錯率低的長流程專案
Claude Opus 5 vs Fable 5

整體來看,Fable 5 仍代表 Anthropic 更高的能力上限,Opus 5 則在效能、成本與使用彈性之間取得更實用的平衡。對多數需要 Coding、Agent 與企業工作流程的團隊來說,Opus 5 更適合作為日常主力模型;若追求最高能力,或有特定高風險任務需求,Fable 5 仍具優勢。

那 Mythos 5 呢?

Mythos 5 與 Fable 5 是同一個底層模型,差別在 Fable 5 額外掛上針對生物、資安與模型蒸餾的安全分類器。Mythos 5 目前只透過 Project Glasswing 開放給受審核對象,無法自助取得。官方也明確表示 Opus 5 沒有推進危險兩用能力的前沿。

企業實測回饋

Anthropic 公告收錄 24 家早期測試夥伴的意見:

  • Zapier 執行長 Wade Foster:Opus 5 登上 AutomationBench 榜首,Token 用量沒有比先前的 Claude 模型多。一項客戶流失防範任務,先前模型都無法通過,Opus 5 拿到 100%。
  • Lovable 共同創辦人 Fabian Hedin:最困難的代理式 Coding 任務較 Opus 4.7 提升 22%,且跑與跑之間的變異小很多,對平台上的開發者來說,穩定度才是決勝點。
  • Box 技術長 Ben Kus:整體較 Opus 4.8 高 8%,資料分析提升 11%、盡職調查提升 17%。

Claude Opus 5 價格與怎麼開始用

  • API 價格:輸入 $5/百萬 Token、輸出 $25/百萬 Token。
  • 模型 IDclaude-opus-5
  • Fast mode:速度約為預設的 2.5 倍,在 Claude Platform 上以基礎價的兩倍計費,Claude Code 則透過 usage credits 使用。
  • 訂閱方案:Claude Max 直接設為預設模型;Claude Pro 上是最強可用模型。
  • 資料保存:一般存取沒有資料保存要求。

同步釋出兩項 beta 更新:

  1. 對話中途更換工具:開發者可在同一段對話中變更 Claude 可用的工具,不會讓 prompt cache 失效。
  2. API 自動回退:被安全分類器標記的請求可自動導向其他模型,開啟後請求會預設路由到當下可用的最佳模型,取代直接被擋掉的處理方式。

Claude Sonnet 5、Opus 5、Fable 5 怎麼選?四種使用情境一次看

選 Sonnet 5:

  • 日常問答、內容整理與一般知識工作
  • 常規 Coding、除錯與開發輔助
  • 大量 API 呼叫、客服與高頻率自動化任務
  • 更重視速度、成本與規模化部署的團隊

選 Opus 5:

  • 日常 Coding、程式碼審查、跨檔案重構
  • 每天要跑的 Agent 工作流與自動化
  • 報告、簡報、財務模型這類長週期知識工作
  • 成本敏感,或需要零資料保存的合規情境

選 Fable 5 或申請 Mythos 級存取:

  • 需要連續跑上數天的超長時程專案
  • 前沿生物研究中的長時間自主任務
  • 深度資安研究(建議走 CVP 或 Project Glasswing)

還在用 Opus 4.8 的團隊:價格沒變、效能上升,多家早期客戶回報 Token 用量還下降,切換理由相當充分。實務上仍建議先在非關鍵流程做 A/B 測試,確認自家 prompt 與工具鏈相容再全面切換。


FAQ:Claude Opus 5 常見問題

Claude Opus 5 什麼時候發布?

已經於 2026 年 7 月 24 日發布,所有平台當日同步上線。

Opus 5 比 Opus 4.8 貴嗎?

價格完全相同,都是輸入 $5、輸出 $25(每百萬 Token)。

Opus 5 和 Fable 5 最大的差別是什麼?

Fable 5 屬 Mythos 級,能力上限較高,但價格是兩倍($10/$50),並帶 30 天資料保存要求與較嚴格的安全分類器。Opus 5 以約一半成本逼近 Fable 5 的表現,在 OSWorld 2.0 等評測甚至以約三分之一成本超越 Fable 5 最佳成績。

Opus 5 有比 Fable 5 更聰明嗎?

分項目而定。官方說法是 Opus 5 在 Coding 與知識工作評測(Frontier-Bench、GDPval-AA)上是新的最佳水準,但資安任務仍落後 Mythos 5。

Claude Pro 用戶可以用 Opus 5 嗎?

可以,Opus 5 是 Claude Pro 上最強的模型。Claude Max 則直接把它設為預設模型。

請求被安全機制擋下會怎樣?

在 Claude.ai、Claude Code 與 Claude Cowork 上,被標記的請求預設回退到 Opus 4.8。API 也可自行啟用自動回退設定。

資安研究者能解除限制嗎?

Anthropic 設有 Cyber Verification Program(CVP),已加入的企業與研究者可取得限制較少的 Opus 5 版本。

  • 260105 新首頁banner 02