Anthropic Claude 模型怎麼選:Fable 5.1、Opus 5.5、Sonnet 5、Haiku 4.5 比較

比較 Anthropic 目前常用 Claude 模型的定位、API ID、上下文、輸出上限與標準價格,說明 Opus、Sonnet、Haiku 如何分工,並整理舊版選型文章。

不確定該選哪款時,先用 Claude Opus 5.5 建立品質基準;長程 Agent 或高難度推理再評估 Fable 5.1;日常開發與寫作可比較 Sonnet 5;低延遲、大量請求則優先試 Haiku 4.5。 選型應看目標任務的驗收率、延遲和總成本,不要把型號名稱當成品質排行榜。

本文整理的是 Anthropic Claude API 的通用模型,不代表 Claude 網頁訂閱、Claude Code 方案或 AWS、Google Cloud 等平台的帳單完全相同。型號與價格會更新,本文依 Anthropic 官方文件核對至 2026 年 9 月 25 日。

目前主力模型:能力、上下文與標準價格

模型 API ID 官方定位 上下文 / 最大輸出 輸入 / 輸出價格(美元 / 百萬 token)
Claude Fable 5.1 claude-fable-5-1 高難度推理、長程 Agent 1M / 128K $10 / $50
Claude Opus 5.5 claude-opus-5-5 長時間 Agent 程式設計與知識工作;Anthropic 建議多數情境先從此款開始 1M / 128K $4 / $20
Claude Sonnet 5 claude-sonnet-5 速度與智慧兼具的平衡選擇 1M / 128K $2 / $10
Claude Haiku 4.5 claude-haiku-4-5 速度最快,能力接近前沿水準 200K / 64K $1 / $5

以上是 Anthropic 第一方 API 的基本 token 價格。提示快取、Batch API、快速模式、資料駐留和雲端平台都可能影響實際帳單。編列預算前請確認使用管道的最新費率。模型總覽 · API 定價

Fable 5.1、Opus 5.5、Sonnet 5 和 Haiku 4.5 都支援文字與圖片輸入、文字輸出、多語言、視覺理解和工具使用。它們的主要差異在任務上限、速度、成本和上下文容量,而不是單純的功能有無。

Opus、Sonnet、Haiku 如何分工

Opus 5.5:先建立實用的品質基準

Anthropic 目前建議不確定時先從 Opus 5.5 開始。它的定位是長時間執行的 Agent 程式設計與知識工作。標準 API 價格為每百萬輸入 token 4 美元、每百萬輸出 token 20 美元。1M 上下文和 128K 輸出上限,適合需要跨檔案、多步驟持續處理的工作。

可先用它處理複雜程式庫變更、跨工具調查、長文件統整和多步驟業務流程。它不一定是最便宜的預設模型:任務範圍明確且容易驗證時,應使用相同輸入比較 Sonnet 或 Haiku。

Fable 5.1:只有難題確實需要時才升級

Fable 5.1 面向高要求推理和長程 Agent 工作,輸入與輸出費率都是 Opus 5.5 的 2.5 倍。若 Opus 5.5 在較高 effort 下仍無法穩定通過驗收,或任務價值足以涵蓋額外費用,再將 Fable 納入評估。

不要只憑型號名稱,就推定它在每一種程式設計、研究或長上下文任務中都更合適。記錄它實際減少了哪些失敗、返工或人工檢查,再與增加的費用比較。

Sonnet 5:把它和 Opus 放在日常任務中比較

Sonnet 5 每百萬輸入 token 2 美元、輸出 token 10 美元。Anthropic 將它定位為速度和智慧的平衡。日常程式修改、文件處理、分析、一般工具呼叫和對延遲敏感的工作,都適合作為評估起點。

它的單位價格是 Opus 5.5 的一半,但不代表每項任務的總花費也恰好減半。不同模型可能產生不同數量的思考 token、工具呼叫和重試,也會造成不同程度的人工返工。請用實際工作負載比較。

Haiku 4.5:用於範圍清楚、吞吐量大的請求

Haiku 4.5 每百萬輸入 token 1 美元、輸出 token 5 美元。Anthropic 將它定位為目前速度最快的模型。它的上下文為 200K,最大輸出為 64K,低於另外三款主力通用模型。

分類、欄位擷取、短摘要、格式轉換、簡單問答和批次分流都是不錯的起點。提供明確的輸出 schema 和驗證規則;若請求需要長程規劃、複雜判斷或多輪工具協作,就設定升級到 Sonnet 或 Opus 的路徑。

價格表以外的費用

提示快取

Anthropic 的提示快取可降低重複上下文的讀取成本。基本規則包括:5 分鐘快取寫入按輸入基本價格的 1.25 倍計費,1 小時寫入按 2 倍計費;快取讀取通常按基本輸入價格的 0.1 倍計費。Fable 5.1 和 Opus 5.5 的讀取倍率更低,分別是 0.025 倍和 0.05 倍。快取是否划算取決於寫入費用與後續命中次數,應依模型計算。快取與定價細節

Batch API

Batch API 適用於可非同步處理的大量請求,輸入與輸出 token 都可享有 50% 折扣。若互動請求必須立即回覆,就不適合使用;離線分類、歸檔、擷取和評估則可能因此降低成本。

Opus 快速模式

截至核對日,快速模式適用於 Opus 5.5、Opus 5 和 Opus 4.8,費率較高。Opus 5.5 快速模式每百萬輸入 token 為 8 美元、輸出 token 為 40 美元;Opus 5 和 Opus 4.8 為 10 / 50 美元。此模式僅適用於 Claude 第一方 API,不應假設 Claude Platform on AWS 或其他雲端平台也有提供。快速模式說明

舊型號與受限型號該怎麼處理

Opus 4.8、Opus 4.7、Sonnet 4.6 等舊型號可能仍出現在既有設定或遷移流程中。遷移前請檢查正確的 API ID、停用日期、上下文限制、提示快取和 tokenizer 行為。不要只替換型號名稱就立即切換所有正式流量;應使用相同的去識別化範例測試新舊版本。

Mythos 系列與其他受限預覽型號不列入一般可用模型比較。只有帳號與平台已獲准存取時,才依相應官方文件評估。新聞或第三方介面中出現型號字串,不代表你的 API 專案一定能呼叫它。

用自己的任務決定預設模型

建立一組能代表日常工作的去識別化樣本,涵蓋成功請求、邊界輸入、過去失敗案例、工具錯誤和長上下文任務。固定提示詞、工具定義、輸出限制和驗收規則,先比較 Opus 5.5 與 Sonnet 5;最難的案例仍未通過時,再加入 Fable 5.1。另以簡單且大量的請求測試 Haiku 4.5。

建議記錄以下指標:

指標 記錄內容
任務品質 是否通過相同驗收標準,以及錯誤類型
實際成本 輸入、輸出、快取、重試與額外工具費用
完成時間 首個 token 延遲與端到端完成時間
人工返工 複核、修改、重新執行所花時間
工具穩定度 呼叫是否正確,失敗後能否妥善恢復

先訂出最低品質門檻,再比較通過驗收工作的總成本。實用的路由策略可以是 Haiku 負責分類、Sonnet 處理日常工作、Opus 解決難題,Fable 僅處理少數高價值的長任務;產品不必讓每個請求都使用同一款模型。

本站先前的 Claude 模型比較

先前發布的《Claude Fable、Opus、Sonnet、Haiku 選型指南》,以及舊版 Opus 4.7、Sonnet 4.6、Haiku 4.5 型號草稿,已合併至本文。本文更新了目前主力型號、價格和上下文資訊;舊文章網址現在會直接跳轉至本文,後續請以本頁作為模型選擇指南。

官方資料