どれを選ぶか迷ったら、まずClaude Opus 5.5で品質の基準を作ります。長期実行型Agentや難しい推論にはFable 5.1を評価し、日常の開発や文章作成ではSonnet 5を比較します。低遅延で大量に処理する作業にはHaiku 4.5を試します。 モデル名を順位表のように扱わず、実際のタスクの合格率、遅延、総コストで選んでください。
この記事では、Anthropic Claude APIの汎用モデルを扱います。ClaudeのWeb版サブスクリプション、Claude Codeのプラン、AWSやGoogle Cloudなどの請求額が同じとは限りません。モデルと価格は更新されるため、情報はAnthropic公式ドキュメントを 2026年9月25日 時点で確認しています。
現行の主力モデル:性能、コンテキスト、標準料金
| モデル | API ID | 公式の位置付け | コンテキスト / 最大出力 | 入力 / 出力料金(USD / 100万 token) |
|---|---|---|---|---|
| Claude Fable 5.1 | claude-fable-5-1 |
高度な推論、長期実行型Agent | 1M / 128K | $10 / $50 |
| Claude Opus 5.5 | claude-opus-5-5 |
長時間のAgentコーディングと知識労働。多くの用途でAnthropicが最初に推奨 | 1M / 128K | $4 / $20 |
| Claude Sonnet 5 | claude-sonnet-5 |
速度と知能のバランス | 1M / 128K | $2 / $10 |
| Claude Haiku 4.5 | claude-haiku-4-5 |
最速で、最先端に近い能力 | 200K / 64K | $1 / $5 |
上記はAnthropic第一者APIの基本token料金です。プロンプトキャッシュ、Batch API、fast mode、データレジデンシー、クラウドプラットフォームによって実際の請求額は変わります。予算を決める際は、利用する経路の最新料金を確認してください。モデル概要 · API料金
Fable 5.1、Opus 5.5、Sonnet 5、Haiku 4.5はいずれもテキストと画像の入力、テキスト出力、多言語、画像認識、ツール利用に対応します。主な違いは、単純な機能の有無ではなく、タスクの上限、速度、コスト、コンテキスト容量です。
Opus、Sonnet、Haikuの使い分け
Opus 5.5:実用的な品質基準を作る
どれを使うか判断できないとき、Anthropicは現在Opus 5.5から始めることを推奨しています。長時間実行するAgentコーディングや知識労働向けで、標準API料金は入力100万tokenあたり4ドル、出力100万tokenあたり20ドルです。1Mコンテキストと128Kの最大出力は、複数ファイルや複数段階にまたがる作業に適しています。
複雑なリポジトリ変更、複数ツールを使う調査、長文書の統合、多段階の業務フローでまず評価できます。常に最も安い既定モデルにする必要はありません。範囲が明確で検証しやすい作業では、同じ入力でSonnetやHaikuも比較します。
Fable 5.1:難しい作業に必要なときだけ上げる
Fable 5.1は高度な推論と長期実行型Agent向けです。入力と出力の料金はOpus 5.5の2.5倍です。Opus 5.5を高いeffortで使っても合格基準を安定して満たせない場合や、タスクの価値が追加コストに見合う場合に評価へ加えます。
モデル名だけを見て、あらゆるコーディング、調査、長文脈タスクに必ず適していると判断しないでください。実際にどの失敗、手戻り、手作業の確認を減らしたかを記録し、増加した費用と比べます。
Sonnet 5:日常業務でOpusと同じ条件で比べる
Sonnet 5の料金は入力100万tokenあたり2ドル、出力100万tokenあたり10ドルです。Anthropicは速度と知能のバランスを重視したモデルと位置付けています。日常的なコード変更、文書処理、分析、通常のツール呼び出し、遅延に敏感な作業の候補になります。
単位料金はOpus 5.5の半分ですが、すべてのタスクの総費用がちょうど半分になるわけではありません。思考token、ツール呼び出し、再試行、手作業の修正量はモデルによって異なります。実際のワークロードで比較してください。
Haiku 4.5:範囲が明確で処理量の多いリクエストに使う
Haiku 4.5は入力100万tokenあたり1ドル、出力100万tokenあたり5ドルです。Anthropicは現行モデルの中で最速と位置付けています。コンテキストは200K、最大出力は64Kで、他の主力汎用モデル3種より小さい値です。
分類、項目抽出、短い要約、形式変換、簡単な質問応答、バッチ振り分けなどから試せます。出力schemaと検証ルールを明確にしてください。長期計画、難しい判断、複数ターンのツール連携が必要な場合はSonnetやOpusへ切り替える経路を用意します。
価格表以外の費用
プロンプトキャッシュ
Anthropicのプロンプトキャッシュは、繰り返し使うコンテキストの読み込み費用を抑えます。基本料金では、5分間のキャッシュ書き込みは入力基本料金の1.25倍、1時間の書き込みは2倍、キャッシュ読み込みは通常0.1倍です。Fable 5.1とOpus 5.5の読み込み倍率はさらに低く、それぞれ0.025倍と0.05倍です。書き込み料金とその後のヒット回数で効果が変わるため、モデルごとに計算してください。キャッシュと料金の詳細
Batch API
Batch APIは非同期で処理できる大量のリクエスト向けで、入力と出力tokenがそれぞれ50%割引になります。対話形式で即時応答が必要な用途には向きませんが、オフライン分類、アーカイブ、抽出、評価の費用を下げられる場合があります。
Opus fast mode
確認日時点では、Opus 5.5、Opus 5、Opus 4.8でfast modeを利用でき、通常より高い料金が適用されます。Opus 5.5は入力100万tokenあたり8ドル、出力100万tokenあたり40ドルです。Opus 5とOpus 4.8は10ドル / 50ドルです。fast modeは第一者Claude APIのみで利用でき、Claude Platform on AWSや他のクラウドプラットフォームで使えるとは限りません。fast modeの説明
旧モデルと利用制限付きモデルの扱い
Opus 4.8、Opus 4.7、Sonnet 4.6などの旧モデルは、既存設定や移行中のワークフローに残っていることがあります。移行前に正確なAPI ID、提供終了日、コンテキスト上限、プロンプトキャッシュ、tokenizerの挙動を確認してください。モデル名だけを置き換えて本番トラフィックを一斉に切り替えず、匿名化した同じサンプルで新旧バージョンを評価します。
Mythosシリーズやその他の利用制限付きプレビューは、一般向けのモデル比較には含めません。アカウントとプラットフォームでアクセスが許可されている場合のみ、該当する公式ドキュメントに基づいて評価してください。ニュースやサードパーティの画面にモデル名があっても、自分のAPIプロジェクトから呼び出せるとは限りません。
自分のタスクで既定モデルを決める
日常業務を代表する匿名化サンプルを用意します。成功例、境界入力、過去の失敗、ツールエラー、長いコンテキストのタスクを含めます。プロンプト、ツール定義、出力制限、合格基準を固定し、まずOpus 5.5とSonnet 5を比較します。難しいサンプルがまだ合格しなければFable 5.1を加えます。Haiku 4.5は簡単で大量に処理するリクエストで別に試します。
次の指標を記録します。
| 指標 | 記録内容 |
|---|---|
| タスク品質 | 同じ合格基準を満たすか、どのようなエラーが起きたか |
| 実際の費用 | 入力、出力、キャッシュ、再試行、追加ツール料金 |
| 完了時間 | 最初のtokenまでの時間とエンドツーエンドの時間 |
| 手作業の修正 | 確認、編集、再実行にかかった時間 |
| ツールの安定性 | 呼び出しが正しいか、失敗から回復できるか |
まず最低限必要な品質を決め、合格したタスクの総費用を比較します。実用的なルーティングでは、分類にHaiku、日常業務にSonnet、難しい作業にOpusを使い、Fableは高価値で長時間の少数タスクに限る方法が考えられます。製品のすべてのリクエストを同じモデルにする必要はありません。
このサイトの過去のClaudeモデル比較
以前公開したClaude Fable、Opus、Sonnet、Haikuの選び方と、Opus 4.7、Sonnet 4.6、Haiku 4.5を扱った旧草稿の内容をこの記事に統合しました。本稿では現行の主力モデル、料金、コンテキスト情報を更新しています。旧URLからはこの記事へ直接転送されます。今後のモデル選びはこの記事を基準にしてください。
公式資料
- Claude Models Overview:現行モデルの推奨、API ID、コンテキスト、出力上限。
- Claude API Pricing:基本料金、プロンプトキャッシュ、Batch API、データレジデンシー、fast mode。