結論:最新か最安ではなく、代表業務の合格率で決める
先に答えると、Claude APIのモデルは「一番新しいものを全処理へ使う」「一番安いものへ統一する」のどちらでも選びません。2026年8月1日のAnthropic公式Models overviewでは、現行の主な選択肢はClaude Fable 5、Claude Opus 5、Claude Sonnet 5、Claude Haiku 4.5です。品質、速度、料金、コンテキスト、出力上限、移行期限を代表データで比較して決めます。
読者の具体的な困りごとは、最新モデルへ変えるたびに費用や出力形式が揺れ、現場が理由を説明できないことです。読了後は、自社業務を六つの比較軸へ分解し、候補モデルを絞れます。次の行動は、問い合わせ、文書抽出、コード、長文判断など代表20件の評価セットを作り、正解と許容時間を記録することです。
現行4モデルの役割と正式なAPI ID
Claude Fable 5のAPI IDはclaude-fable-5で、公式には広く提供される最も高能力なモデル、長時間エージェント向けとされています。入力10ドル、出力50ドル/100万トークン、1Mコンテキスト、最大128k出力です。能力が必要な業務へ限定し、軽い分類へ一律採用しません。
Claude Opus 5はclaude-opus-5です。複雑なエージェント型コーディングと企業業務向けで、入力5ドル、出力25ドル、1Mコンテキスト、最大128k出力です。難しいコード変更、複数段階の調査、長い判断を扱う候補ですが、Fableと同様にレビュー基準を先に置きます。
Claude Sonnet 5はclaude-sonnet-5です。速度と知能の組み合わせを重視するモデルで、2026年8月31日までは入力2ドル、出力10ドルの導入価格、9月1日以降は3ドル/15ドルです。1Mコンテキスト、最大128k出力を持ち、一般的な業務APIの基準モデルとして比較しやすい選択肢です。
Claude Haiku 4.5はclaude-haiku-4-5-20251001、別名claude-haiku-4-5です。入力1ドル、出力5ドル、200kコンテキスト、最大64k出力で、速度と費用を重視する分類、抽出、短い要約の候補です。ただし安価でも、誤分類の損失が大きい業務では上位モデルと比較します。
モデル選定の6つの比較軸
- 正確性:自社の正解データで合格率、重大誤り、見落としを測ります。
- 速度:平均だけでなく95パーセンタイルとタイムアウトを確認します。
- 総費用:入力、出力、キャッシュ、再試行、人間レビューを合算します。
- 文脈:投入可能量ではなく、本当に必要な情報だけで精度を比較します。
- 出力:JSON形式、文章量、引用、拒否、ツール利用の安定性を確認します。
- 運用:提供基盤、地域、廃止予定、移行テスト、ロールバックを確認します。
単価比較だけでは、安いモデルで再試行やレビューが増える問題を見落とします。たとえば一件の入力単価が半分でも、二回再試行し、人間確認が五分増えれば総費用は上がります。逆に、高能力モデルでなければ処理できないと思っていた分類がHaikuで合格する場合もあります。実データで工程全体を測ります。
業務別の選び分け
大量の定型分類、短い情報抽出、一次振り分けはHaiku 4.5から試します。ただし自動確定せず、信頼度が低いもの、規約違反、返金、個人情報などを人間確認へ送る分岐を作ります。高速で安価でも、例外処理がなければ業務事故を増やします。
問い合わせ回答案、文書要約、ツールを使う一般エージェント、速度と品質の両方が必要なコード作業はSonnet 5を基準候補にします。8月中の導入価格を恒久単価として予算化せず、9月以降の標準単価で見積もるか、価格切替前後を分けます。
複雑なコードベースの変更、長い調査、複数の制約を守る企業判断はOpus 5を比較します。Fable 5は最高能力が必要な長時間エージェントや、Opusでも合格率が足りない高難度業務の候補です。高能力モデルでも事実確認、権限、承認は省略できません。
一つのシステムでモデルを分ける場合は、入力内容だけで自由に選ばせず、業務分類とリスクに基づくルーティング表を作ります。モデル名、選択理由、実行時刻、評価結果を残すと、障害や費用増加を追跡できます。失敗時に上位モデルへ切り替える条件と最大回数も決めます。
5段階の評価・移行手順
- 代表20〜100件を選び、正解、重大誤り、許容時間、最大費用を定義します。
- 現在モデルと候補モデルへ同じ入力を渡し、出力を匿名化して評価します。
- 品質、速度、トークン、人間確認、失敗率を同じ表で比較します。
- 影響の小さい業務から10%、30%、100%へ段階移行します。
- 旧モデルへ戻す条件、監視期間、担当者、廃止日を記録します。
評価セットは成功例だけでなく、長文、曖昧入力、欠損、禁止情報、矛盾、ツール障害を含めます。平均点が高くても、一件の重大誤りが顧客や法務へ影響するなら不合格です。モデル変更と同時にプロンプト、検索、ツール、閾値を全部変えると原因が分からないため、一項目ずつ比較します。
モデル移行では、旧モデルの出力を新モデルが完全再現するとは期待しません。文章量、構造化出力、拒否、ツール呼び出しが変わる可能性があります。利用SDK、max_tokens、thinkingやeffort、JSON検証、タイムアウトを含む統合テストを行います。
モデルIDと廃止予定を運用に組み込む
Anthropic公式は、日付を含まないClaude 4.6以降のモデルIDも固定スナップショットであり、常に最新版へ自動更新するポインタではないと説明しています。つまり「指定したままでも最新になる」と考えず、Models overview、リリースノート、Model deprecationsを定期確認します。
Model deprecationsではactive、legacy、deprecated、retiredを区別します。deprecatedになったら推奨代替と終了日を確認し、retired前に評価と切替を終えます。ConsoleのUsageからAPIキー・モデル別CSVを出し、古いIDが残るバッチ、環境変数、テスト、バックアップ処理を探します。
クラウド基盤では提供ID、提供時期、地域、廃止日が異なる場合があります。Claude APIで動くIDをBedrockやGoogle Cloudへそのまま使えるとは限りません。契約中の基盤で正式ID、地域、料金を確認し、検証環境と本番環境の設定差を台帳化します。
公開前・移行前チェックリスト
正式名称/API ID/active状態/提供基盤/入力単価/出力単価/キャッシュ単価/Batch単価/文脈長/最大出力/速度/代表データ合格率/重大誤り/再試行/レビュー工数/廃止予定/ロールバック、を確認します。公式確認日も残します。
「1Mコンテキストだから全資料を入れる」「最高モデルだからレビュー不要」「最安だから大量処理へ使う」という判断は避けます。必要情報だけを渡し、権限と人間確認を別ゲートにし、モデルの能力と業務の安全性を混同しません。
関連ガイドと公式情報
定額契約との違いはClaude料金プラン比較、API費用はClaude API料金の削減手順、個別モデルはClaude Opus 5の選び方、一般的な比較はClaude最新モデルの違いも確認してください。
正式なモデル名、ID、仕様はAnthropic公式Models overview、単価は公式Pricing、終了予定は公式Model deprecationsで公開直前に再確認してください。
Miraigentの無料診断では、代表業務、評価基準、モデル、費用、人間確認、移行手順を一枚にし、最新モデルへの変更を説明できる運用へ整理します。
