Anthropic 於二零二六年十月七日發布 Claude Haiku 5.5,定位為該公司迄今速度最快、成本最低的小型模型。官方指出,此模型在多數工作負載下的執行成本較前代 Haiku 4.5 平均下降約七成五,同時在知識工作、電腦操作與代理式編碼等基準上大幅躍進,並首次在 Haiku 級別加入可調節的推理強度設定。
Claude Haiku 5.5 是 Anthropic 於二零二六年十月七日推出的小型模型,主打高速與低成本,執行成本較前代下降約七成五,並支援可調節推理強度。
Claude Haiku 5.5 是什麼樣的模型?
Claude Haiku 5.5 是 Anthropic 的小型旗艦模型,鎖定高頻且成本敏感的任務,例如摘要、上下文壓縮與分類,並可作為大型模型的子代理。
Claude Haiku 5.5 延續 Haiku 系列的小型定位,官方描述它為「體積最小、速度最快、能力最強」的小型模型,設計目標是處理高頻且成本敏感的任務。該公司列舉的典型場景包括摘要、上下文壓縮、資料庫查詢與分類請求,這些工作單次價值有限,但呼叫量龐大,對單位成本極為敏感。
除了獨立使用,Haiku 5.5 也被定位為大型模型的子代理。官方建議將它與 Opus 5.5、Sonnet 5.5 搭配,在編碼任務中負責範圍明確的子工作。Anthropic 強調,由於它是旗下速度最快的模型,因此在即時客服、瀏覽器操作等對延遲敏感的場景特別合適。
值得注意的是,這是 Haiku 系列首次具備可調節的推理強度設定。使用者可以像操作其他 Claude 模型一樣,在成本與智慧之間自行取捨,低強度追求便宜與快速,高強度則換取較佳的正確率。
Claude Haiku 5.5 的效能提升有多大?
官方基準顯示,Haiku 5.5 在 GDPval-AA 知識工作取得一千六百二十分,前代為七百三十五分;電腦操作由一成六升至七成二,多項指標明顯超越前代。
根據 Anthropic 公布的數據,Haiku 5.5 在多項基準上與前代拉開明顯差距。以評估真實專業工作的 GDPval-AA v2.1 為例,Haiku 5.5 取得一千六百二十分,而 Haiku 4.5 僅七百三十五分。在 AA-Briefcase v1.1 上,兩者分別為一千五百七十八分與六百一十四分。
在電腦操作方面,OSWorld 2.1 的線下子集成績由 Haiku 4.5 的一成六提升至七成二,已接近 Sonnet 5.5 的八成四。代理式編碼的 Terminal-Bench 4.0 亦由前代的零分升至三成九。多領域推理的 Humanity’s Last Exam,在不使用工具的情況下由一成提升至四成六,使用工具後達五成七。
官方同時列出競品對照,GPT-6 Luna 在上述多項基準仍具優勢,Sonnet 5.5 則維持較高上限。這也說明 Haiku 5.5 的定位並非取代大型模型,而是在成本敏感的場景中提供足夠可用的能力。
Claude Haiku 5.5 的價格與成本優勢如何?
Haiku 5.5 每百萬輸入 token 最低零點一美元、輸出零點五美元,較前代便宜約七成五;若提示超過十萬 token,輸入為零點五美元、輸出二點五美元。
定價是此次發布的核心賣點。官方公布的價格表顯示,在提示不超過十萬 token 的情境下,Haiku 5.5 每百萬輸入 token 為零點一美元、輸出為零點五美元;快取讀取為零點零一美元,快取寫入為零點一二五美元。若提示超過十萬 token,輸入與輸出分別為零點五美元與二點五美元。
與前代相比,Haiku 4.5 的輸入為每百萬 token 一美元、輸出為五美元。換言之,新模型在常見情境下的輸入成本降至十分之一。Anthropic 補充,前代 Haiku 約九成的請求都落在十萬 token 以內,因此多數使用者可直接受惠。官方換算後指出,整體執行成本平均下降約七成五。
同步宣布的還有 Sonnet 5.5 的快取讀取降價,價格由每百萬 token 零點二美元降至零點一美元。由於快取讀取在模型 token 消耗中占比龐大,Anthropic 估計此舉可讓 Sonnet 5.5 在多數代理式任務上便宜約兩成。
此外,該公司將向付費訂閱者發放每月 API 額度,Max 5x 用戶為一百美元、Max 20x 用戶為二百美元,Team 訂閱者則依人數池化,上限五百美元。這批額度可用於任何 Claude 模型,目的是鼓勵開發者打造呼叫 API 的工具與代理。
業界對 Claude Haiku 5.5 的評價如何?
多家早期測試客戶反映速度與準確度兼具,Asana 稱任務完成延遲下降逾三成,HubSpot 在 CRM 測試取得九成二八的歷來最佳成績,Box 則稱準確度提升十一分。
Anthropic 引述多家早期測試客戶的意見。Asana 的工程師表示,其 AI 代理產品在改用 Haiku 5.5 後,任務完成延遲下降超過三成,每個代理回合的推論速度提升最多二點五倍。HubSpot 指出,該模型在客戶關係管理任務測試中取得九成二八的平均分數,是歷來最佳,且在辨識過期紀錄的稽核任務中速度最快、命中率最高。
AlphaSense 提到,其文件問答功能每週約有八百萬次呼叫,以四百條查詢測試後,Haiku 5.5 的表現顯著優於前代。Box 則表示,在相同企業內容任務上,新模型準確度較前代高十一分,延遲約為一半。Cognition 也宣布把 Haiku 5.5 納入其代理產品的輔助模型選項。
這些回饋共同指向同一方向:當模型能力跨過可用門檻後,速度與成本往往成為實際採用的關鍵變數。對需要大量呼叫 API 的團隊而言,單位價格的下降可能比基準分數的微幅領先更具決定性。
使用 Claude Haiku 5.5 需要注意什麼?
模型已於 AWS、Google Cloud 與 Microsoft Azure 上線,開發者以 claude-haiku-5-5 呼叫;其網路安全防護較前代嚴格。
在資安與安全防護方面,Anthropic 說明 Haiku 5.5 的網路安全限制較前代更嚴格,但仍比 Sonnet 5.5 寬鬆,允許較多防禦性任務,同時會阻擋滲透測試等較可能被攻擊者利用的技術。生物領域的防護水準則與 Sonnet 5、Sonnet 5.5 及 Opus 5 相同,研究型問題可獲解答,但可能造成危害的請求會被限制。需要更廣泛生物或資安作業的機構,可申請對應的驗證計畫。
可用性方面,模型已同步在 Amazon Web Services、Google Cloud 與 Microsoft Azure 上線,開發者透過 claude-haiku-5-5 這個模型代號即可呼叫。官方亦更新了 Python 與 TypeScript 開發套件,在測試階段加入電腦操作與瀏覽器操作支援。
對於既有使用者,官方提供了遷移指南。需要留意的是,若工作任務本身高度複雜,例如長時間、多步驟的代理式編碼,Anthropic 仍建議選用 Sonnet 5.5 或 Opus 5.5,Haiku 5.5 的優勢在於範圍明確、可大量重複的任務。
出處連結有哪些?
本文資料來源為 Anthropic 官方發布頁面,內含模型代號、基準測試、定價表與可用平台;讀者可循來源連結查閱完整系統卡與遷移指南。
官方發布頁面:https://www.anthropic.com/claude-haiku-5-5
頁面包含模型代號、各項基準測試、完整定價表、安全防護說明與可用平台清單,並附上系統卡連結。若需要更細節的評測方法與限制條件,可直接查閱該頁面的後續更新段落。
總結:Claude Haiku 5.5 適合什麼團隊?
Haiku 5.5 適合需要大量呼叫 API、對單位成本與延遲敏感的團隊,例如客服自動化、文件問答與子代理工作;需要高難度代理式編碼者仍宜選用大型模型。
Claude Haiku 5.5 的意義,在於把小型模型的能力門檻與成本曲線同時推進。當執行成本平均下降約七成五,原本因價格而不划算的任務,例如逐筆文件問答、即時分類與大量子代理,開始具備商業可行性。
它並非萬能。面對長時間、多步驟且高度複雜的代理式編碼,官方自己仍建議採用 Sonnet 5.5 或 Opus 5.5。因此更務實的用法,是把它視為整條模型組合中的低成本層,負責明確、可重複的工作,將昂貴的大型模型留給真正需要深度推理的環節。
對開發團隊而言,值得優先評估的,是那些目前因單價過高而遭擱置的批次任務。當單位成本降至前代的四分之一以內,原本算不過來的帳,很可能就此成立。