
Anthropic 於 2026 年 10 月 7 日發布 Claude Haiku 5.5,官方形容它是歷來最便宜、最快且能力最強的小型模型[1]。新模型即日在 Amazon Web Services、Google Cloud 及 Microsoft Azure 上架,開發者可透過模型代號 claude-haiku-5-5 使用[1]。定價方面,十萬 token 以內的請求較 Haiku 4.5 便宜九成,超過十萬 token 的請求則便宜五成,整體平均運行成本下降約七成半[1]。
主打高頻而成本敏感的工作
官方指出,Haiku 5.5 專為高頻且成本敏感的任務而設,能穩定處理摘要、上下文壓縮、資料庫查詢及分類等重複性工作[1]。由於它同時是 Anthropic 目前最快的模型,官方認為它適合即時客戶支援及瀏覽器操作等對速度敏感的場景[1]。在代理式編程工作方面,Haiku 5.5 可與 Opus 5.5 及 Sonnet 5.5 配搭,擔任子代理角色,負責範圍較窄但需要大量重複執行的任務[1]。
基準測試表現大幅提升
Anthropic 公布的測試數據顯示,Haiku 5.5 在多項基準上明顯領先前代:知識工作基準 GDPval-AA v2.1 由 Haiku 4.5 的 735 分升至 1,620 分;電腦操作基準 OSWorld 2.1 由 15.7% 升至 72.4%;代理式編程基準 Terminal-Bench 4.0 由 0% 升至 39.2%[1]。Haiku 5.5 亦是首個提供可調節「努力程度」設定的 Haiku 級模型,用戶可按需要在成本與智能之間取捨[1]。官方引述客戶測試結果,Asana 稱任務完成延遲減少逾三成、每個代理回合的推論速度最多快 2.5 倍,HubSpot 則錄得 92.8% 的 CRM 測試平均分[1]。
同步下調 Sonnet 快取讀取價格
與新模型同步,Anthropic 把 Claude Sonnet 5.5 的快取讀取價格減半,由每百萬 token 0.2 美元降至 0.1 美元,使 Sonnet 5.5 在多數代理式工作上的成本下降約兩成[1]。此外,官方由本週起向 Max 及 Team 訂戶派發每月 API 額度:Max 5x 用戶每月 100 美元、Max 20x 用戶 200 美元,Team 訂戶最多 500 美元並由成員共用,額度可用於任何 Claude 模型[1]。Anthropic 亦更新 Claude 的 Python 及 TypeScript SDK,加入電腦操作與瀏覽器操作支援(beta)[1]。