不確定該選哪款時,先用 Claude Opus 5.5 建立品質基準;長程 Agent 或高難度推理再評估 Fable 5.1;日常開發與寫作可比較 Sonnet 5;低延遲、大量請求則優先試 Haiku 4.5。 選型應看目標任務的驗收率、延遲和總成本,不要把型號名稱當成品質排行榜。
本文整理的是 Anthropic Claude API 的通用模型,不代表 Claude 網頁訂閱、Claude Code 方案或 AWS、Google Cloud 等平台的帳單完全相同。型號與價格會更新,本文依 Anthropic 官方文件核對至 2026 年 9 月 25 日。
目前主力模型:能力、上下文與標準價格
| 模型 | API ID | 官方定位 | 上下文 / 最大輸出 | 輸入 / 輸出價格(美元 / 百萬 token) |
|---|---|---|---|---|
| Claude Fable 5.1 | claude-fable-5-1 |
高難度推理、長程 Agent | 1M / 128K | $10 / $50 |
| Claude Opus 5.5 | claude-opus-5-5 |
長時間 Agent 程式設計與知識工作;Anthropic 建議多數情境先從此款開始 | 1M / 128K | $4 / $20 |
| Claude Sonnet 5 | claude-sonnet-5 |
速度與智慧兼具的平衡選擇 | 1M / 128K | $2 / $10 |
| Claude Haiku 4.5 | claude-haiku-4-5 |
速度最快,能力接近前沿水準 | 200K / 64K | $1 / $5 |
以上是 Anthropic 第一方 API 的基本 token 價格。提示快取、Batch API、快速模式、資料駐留和雲端平台都可能影響實際帳單。編列預算前請確認使用管道的最新費率。模型總覽 · API 定價
Fable 5.1、Opus 5.5、Sonnet 5 和 Haiku 4.5 都支援文字與圖片輸入、文字輸出、多語言、視覺理解和工具使用。它們的主要差異在任務上限、速度、成本和上下文容量,而不是單純的功能有無。
Opus、Sonnet、Haiku 如何分工
Opus 5.5:先建立實用的品質基準
Anthropic 目前建議不確定時先從 Opus 5.5 開始。它的定位是長時間執行的 Agent 程式設計與知識工作。標準 API 價格為每百萬輸入 token 4 美元、每百萬輸出 token 20 美元。1M 上下文和 128K 輸出上限,適合需要跨檔案、多步驟持續處理的工作。
可先用它處理複雜程式庫變更、跨工具調查、長文件統整和多步驟業務流程。它不一定是最便宜的預設模型:任務範圍明確且容易驗證時,應使用相同輸入比較 Sonnet 或 Haiku。
Fable 5.1:只有難題確實需要時才升級
Fable 5.1 面向高要求推理和長程 Agent 工作,輸入與輸出費率都是 Opus 5.5 的 2.5 倍。若 Opus 5.5 在較高 effort 下仍無法穩定通過驗收,或任務價值足以涵蓋額外費用,再將 Fable 納入評估。
不要只憑型號名稱,就推定它在每一種程式設計、研究或長上下文任務中都更合適。記錄它實際減少了哪些失敗、返工或人工檢查,再與增加的費用比較。
Sonnet 5:把它和 Opus 放在日常任務中比較
Sonnet 5 每百萬輸入 token 2 美元、輸出 token 10 美元。Anthropic 將它定位為速度和智慧的平衡。日常程式修改、文件處理、分析、一般工具呼叫和對延遲敏感的工作,都適合作為評估起點。
它的單位價格是 Opus 5.5 的一半,但不代表每項任務的總花費也恰好減半。不同模型可能產生不同數量的思考 token、工具呼叫和重試,也會造成不同程度的人工返工。請用實際工作負載比較。
Haiku 4.5:用於範圍清楚、吞吐量大的請求
Haiku 4.5 每百萬輸入 token 1 美元、輸出 token 5 美元。Anthropic 將它定位為目前速度最快的模型。它的上下文為 200K,最大輸出為 64K,低於另外三款主力通用模型。
分類、欄位擷取、短摘要、格式轉換、簡單問答和批次分流都是不錯的起點。提供明確的輸出 schema 和驗證規則;若請求需要長程規劃、複雜判斷或多輪工具協作,就設定升級到 Sonnet 或 Opus 的路徑。
價格表以外的費用
提示快取
Anthropic 的提示快取可降低重複上下文的讀取成本。基本規則包括:5 分鐘快取寫入按輸入基本價格的 1.25 倍計費,1 小時寫入按 2 倍計費;快取讀取通常按基本輸入價格的 0.1 倍計費。Fable 5.1 和 Opus 5.5 的讀取倍率更低,分別是 0.025 倍和 0.05 倍。快取是否划算取決於寫入費用與後續命中次數,應依模型計算。快取與定價細節
Batch API
Batch API 適用於可非同步處理的大量請求,輸入與輸出 token 都可享有 50% 折扣。若互動請求必須立即回覆,就不適合使用;離線分類、歸檔、擷取和評估則可能因此降低成本。
Opus 快速模式
截至核對日,快速模式適用於 Opus 5.5、Opus 5 和 Opus 4.8,費率較高。Opus 5.5 快速模式每百萬輸入 token 為 8 美元、輸出 token 為 40 美元;Opus 5 和 Opus 4.8 為 10 / 50 美元。此模式僅適用於 Claude 第一方 API,不應假設 Claude Platform on AWS 或其他雲端平台也有提供。快速模式說明
舊型號與受限型號該怎麼處理
Opus 4.8、Opus 4.7、Sonnet 4.6 等舊型號可能仍出現在既有設定或遷移流程中。遷移前請檢查正確的 API ID、停用日期、上下文限制、提示快取和 tokenizer 行為。不要只替換型號名稱就立即切換所有正式流量;應使用相同的去識別化範例測試新舊版本。
Mythos 系列與其他受限預覽型號不列入一般可用模型比較。只有帳號與平台已獲准存取時,才依相應官方文件評估。新聞或第三方介面中出現型號字串,不代表你的 API 專案一定能呼叫它。
用自己的任務決定預設模型
建立一組能代表日常工作的去識別化樣本,涵蓋成功請求、邊界輸入、過去失敗案例、工具錯誤和長上下文任務。固定提示詞、工具定義、輸出限制和驗收規則,先比較 Opus 5.5 與 Sonnet 5;最難的案例仍未通過時,再加入 Fable 5.1。另以簡單且大量的請求測試 Haiku 4.5。
建議記錄以下指標:
| 指標 | 記錄內容 |
|---|---|
| 任務品質 | 是否通過相同驗收標準,以及錯誤類型 |
| 實際成本 | 輸入、輸出、快取、重試與額外工具費用 |
| 完成時間 | 首個 token 延遲與端到端完成時間 |
| 人工返工 | 複核、修改、重新執行所花時間 |
| 工具穩定度 | 呼叫是否正確,失敗後能否妥善恢復 |
先訂出最低品質門檻,再比較通過驗收工作的總成本。實用的路由策略可以是 Haiku 負責分類、Sonnet 處理日常工作、Opus 解決難題,Fable 僅處理少數高價值的長任務;產品不必讓每個請求都使用同一款模型。
本站先前的 Claude 模型比較
先前發布的《Claude Fable、Opus、Sonnet、Haiku 選型指南》,以及舊版 Opus 4.7、Sonnet 4.6、Haiku 4.5 型號草稿,已合併至本文。本文更新了目前主力型號、價格和上下文資訊;舊文章網址現在會直接跳轉至本文,後續請以本頁作為模型選擇指南。
官方資料
- Claude Models Overview:現行模型建議、API ID、上下文和輸出限制。
- Claude API Pricing:基本價格、提示快取、Batch API、資料駐留和快速模式。