
Claude Haiku 5.5 發表:成本降低 75%、速度再升級!Opus、Sonnet、Haiku 三大模型怎麼選?

Anthropic 於 10 月 7 日正式推出 Claude Haiku 5.5,主打更低成本、更快的推論速度,以及大幅提升的電腦操作與知識工作能力。根據官方數據,Haiku 5.5 的平均執行成本較前代 Haiku 4.5 降低約 75%,成為 Anthropic 目前速度最快、價格最低的小型模型。
隨著 Haiku 5.5 上線,Claude 5.5 系列也正式集結 Opus、Sonnet、Haiku 三款模型,分別鎖定高複雜度工作、日常專業任務,以及高頻率自動化應用。Anthropic 同步宣布調降 Sonnet 5.5 的快取讀取價格,進一步降低 AI Agent 的長期運作成本。
Claude Haiku 5.5 是什麼?三大升級重點
Claude Haiku 5.5 是 Anthropic 最新推出的輕量級 AI 模型,主要針對大量、重複、對成本與反應時間敏感的工作負載設計,包括文件摘要、資料分類、資料庫查詢、即時客服、瀏覽器操作,以及 AI Agent 的子任務執行。
這次更新有三大重點:
- 成本大幅降低: 平均任務成本較 Haiku 4.5 下降約 75%,10 萬 Token 以內的輸入單價降至每百萬 Token 0.10 美元。
- 速度與能力同步提升: 成為 Anthropic 標準速度下最快的模型,電腦操作與知識工作評測均有明顯進步。
- 首次支援 Effort 調整: 使用者可以依任務需求調整推理投入程度,在執行品質、速度及 Token 成本之間取得平衡。
Anthropic 將 Haiku 5.5 定位為適合高用量、成本敏感型應用的模型,也能搭配 Opus 5.5、Sonnet 5.5,負責大型 AI Agent 工作流程中的子任務。
Haiku 5.5 效能提升多少?電腦操作、推理與 Coding 全面升級
根據 Anthropic 官方評測,Claude Haiku 5.5 在電腦操作、專業推理、程式開發及知識工作等領域均較前代顯著進步。其中,電腦操作能力提升最為突出,也讓輕量級模型更適合應用於 AI Agent、自動化工作流程與企業系統。

Haiku 5.5 核心能力與應用特色
- AI Agent 應用擴展: Anthropic 同步更新 Python、TypeScript SDK,提供測試版 Computer Use 與 Browser Use 支援,讓開發者能建立操作網頁與電腦介面的 AI Agent。
- 電腦操作大幅提升: OSWorld 2.1 從 15.7% 提升至 72.4%,可支援跨畫面互動、瀏覽器操作與多步驟自動化任務。
- 專業推理能力升級: HLE 成績從 10.2% 提升至 45.9%,有助於處理需要知識理解、分析與判斷的工作。
- Coding 能力進步: Terminal-Bench 4.0 達 39.2%,適合程式碼檢查、簡單修改、文件查詢與 Coding Agent 子任務;大型專案仍建議選擇 Sonnet 或 Opus。
- 視覺理解能力增強: Chartography 從 6.4% 提升至 46.4%,可應用於圖表解讀、資料視覺化分析與文件處理。
- 知識工作效率提高: GDPval-AA v2.1 從 735 分提升至 1,620 分,適合文件摘要、資料整理、企業知識檢索及客服應用。
Claude Opus、Sonnet、Haiku 5.5 怎麼選?三大模型完整比較
隨著 Haiku 5.5 正式推出,Claude 5.5 系列已涵蓋三種不同工作需求。Anthropic 將 Opus 定位於複雜知識工作、Sonnet 專注範圍明確的專業任務,Haiku 則負責高速、大量且重複性的工作。
| 比較項目 | Opus 5.5 | Sonnet 5.5 | Haiku 5.5 |
|---|---|---|---|
| 核心定位 | 複雜推理、專業工作 | 速度與能力平衡 | 高速、低成本 |
| 推論速度 | 中等 | 快 | 最快 |
| 程式開發 | 大型專案、複雜架構 | 日常 Coding、除錯 | 簡易修改、子任務 |
| 內容工作 | 深度研究、策略分析 | 文章、簡報、文件 | 摘要、分類、擷取 |
| AI Agent | 主代理、長期任務 | 工作流程執行 | 子代理、批次任務 |
| Context Window | 100 萬 | 100 萬 | 100 萬 |
| 最大輸出 | 12.8 萬 | 12.8 萬 | 12.8 萬 |
| API 輸入/百萬 Token | US$4 | US$2 | US$0.10 起 |
| API 輸出/百萬 Token | US$20 | US$10 | US$0.50 起 |
Haiku 5.5 的低價適用於提示詞長度 10 萬 Token 以內的請求,超過後採較高費率。
Claude 5.5 API 價格比較:Haiku 最低只要 0.10 美元
Anthropic 此次將 Haiku 5.5 的 API 費用大幅調降,對長時間運行的 AI Agent、企業客服及高頻率 API 應用具有直接影響。
| API 費用(每百萬 Token) | Opus 5.5 | Sonnet 5.5 | Haiku 5.5 ≤100K | Haiku 5.5 >100K |
|---|---|---|---|---|
| Input | $4 | $2 | $0.10 | $0.50 |
| Output | $20 | $10 | $0.50 | $2.50 |
| Cache Read | $0.20 | $0.10 | $0.01 | $0.05 |
| Cache Write(5 分鐘) | $5 | $2.50 | $0.125 | $0.625 |
Sonnet 5.5 快取讀取價格採 10 月 7 日公告新費率;Haiku 依提示詞長度區分價格。
來源:Anthropic 發表公告及 API 文件。
以提示詞長度在 10 萬 Token 以內的請求計算,Haiku 5.5 每百萬輸入 Token 只需 0.10 美元,約為 Sonnet 5.5 的二十分之一、Opus 5.5 的四十分之一。輸出 Token 也維持相同價差。
不過,Haiku 5.5 採取分級定價,當單次提示詞超過 10 萬 Token,輸入與輸出單價都將提高五倍。開發者在設計長上下文工作流程時,仍需留意成本變化。
💡 AI 訂閱省錢指南
Sonnet 5.5 快取價格減半,Agent 成本再降約 20%
除了 Haiku 5.5 的價格調整,Anthropic 也同步將 Sonnet 5.5 的 Cache Read 單價從每百萬 Token 0.20 美元降至 0.10 美元,降幅達 50%。
由於 AI Agent 執行多步驟任務時,經常反覆讀取對話脈絡、工具結果及專案資訊,快取讀取費用占有一定比例。Anthropic 估計,此次調整可讓 Sonnet 5.5 在多數 Agentic 工作中的整體執行成本降低約 20%。
Claude Haiku 5.5 可以用在哪些地方?企業實際案例
Anthropic 在官方公告中分享多家企業的早期測試,包括 Asana、HubSpot、AlphaSense、Box,以及 AI Coding 平台 Cognition,呈現 Haiku 5.5 在真實產品環境中的應用潛力。
| 企業 | 應用情境 | 早期測試結果 |
|---|---|---|
| Asana | AI 工作管理、專案搜尋 | 任務完成延遲降低逾 30%,每回合推論最快提升 2.5 倍 |
| HubSpot | CRM 客戶資料稽核 | 內部模擬任務平均得分 92.8% |
| AlphaSense | 文件問答與搜尋 | 400 筆查詢測試評分由 0.76 提升至 0.84 |
| Box | 企業文件分析 | 比 Haiku 4.5 高 11 分,延遲約減半 |
| Cognition | Devin Fusion Coding 子代理 | 搭配 Opus 5.5,FrontierCode 得分達 66.2 |

Anthropic 開發者團隊 ClaudeDevs 透過「Egg Drop Test(雞蛋防摔測試)」,比較 Opus 5.5 單獨執行,以及搭配 10 個 Haiku 5.5 子代理的表現。測試中,由 Opus 負責規劃與協調,Haiku 子代理並行探索不同設計方案,最終成功達成 32 公尺雞蛋防摔目標,執行時間與成本均降低約 53%。這項案例展現多模型協作的應用潛力,透過大型模型負責決策、小型模型處理大量子任務,有機會提升 AI Agent 的執行效率並降低整體成本。
這些案例顯示,低成本模型在大量標準化工作中具有實際價值。尤其在文件搜尋、財務資料查詢、CRM 資料管理等工作,企業可以透過高頻率呼叫小型模型,降低自動化流程的整體成本。
Claude Haiku 5.5 如何使用?支援平台與 API
Anthropic 表示,Haiku 5.5 已於 10 月 7 日推出,並支援 Claude Platform、Amazon Web Services、Google Cloud 及 Microsoft Azure 等平台。
開發者可透過 Claude API 使用,模型 ID 為:
claude-haiku-5-5複製
官方另宣布將向 Claude Max 與 Team 訂閱者提供每月 API Credits:
- Max 5x:每月 US$100 Credits
- Max 20x:每月 US$200 Credits
- Team:每月最多 US$500 Credits,由團隊成員共享
API Credits 可用於 Claude Platform 上的各種模型,實際使用仍依帳號權限及官方規則為準。
Claude Haiku 5.5 常見問題 FAQ
Q1:Claude Haiku 5.5 免費嗎?
Haiku 5.5 透過 Claude API 採 Token 用量計費,最低每百萬輸入 Token 為 0.10 美元。Claude 聊天產品的免費額度與模型開放權限,需以帳號當下顯示為準。
Q2:Haiku 5.5 和 Sonnet 5.5 哪個比較好?
需要即時回應、大量文件處理、內容分類,可選 Haiku 5.5;日常 Coding、網站開發、簡報及專業文件工作,建議 Sonnet 5.5。
Q3:Opus 5.5、Sonnet 5.5、Haiku 5.5 最大差別是什麼?
Opus 5.5 著重複雜推理與長時間專案;Sonnet 5.5 平衡速度、能力與成本;Haiku 5.5 主打高吞吐量、低延遲與低成本。
Q4:Haiku 5.5 支援 100 萬 Token 嗎?
支援。Claude 5.5 三款模型均提供 100 萬 Token Context Window,最大一般輸出為 12.8 萬 Token。其中 Haiku 5.5 對超過 10 萬 Token 的提示詞採較高費率。
Anthropic 補齊 Claude 5.5 系列,AI Agent 成本競爭持續升溫
Haiku 5.5 的推出,反映 Anthropic 開始進一步強化小型模型在企業自動化市場的競爭力。隨著 AI Agent 逐漸從單次問答延伸至長時間執行、跨工具操作與多代理協作,Token 成本、執行速度與任務成功率,將直接影響企業導入 AI 的效益。
這次值得關注的是 Anthropic 對整個 Claude 5.5 系列的分工安排。Opus 負責複雜推理與主代理決策,Sonnet 承接專業工作流程,Haiku 則大量處理資料查詢、摘要與子任務。透過模型分工,開發者可依工作複雜度分配算力,避免所有任務都使用高成本模型。
隨著 OpenAI、Google、Anthropic 持續推出更高效率的模型,AI 產業競爭也逐步延伸至企業真正關心的問題:如何用更低的成本,讓 AI Agent 穩定完成更多工作。



