2026年9月1日にClaude Fable 5.1が出て、Claudeのモデルは、Fable 5.1、Opus 5、Sonnet 5、Haiku 4.5の4段になりました。単価は上から順に、100万トークンあたり入力10ドル・出力50ドル、5ドル・25ドル、2ドル・10ドル、1ドル・5ドルです。上と下で10倍違います(記事末尾の出典参照)。
以前、企業規模別の費用シミュレーションの記事で、費用を膨らませるのは「全員に最上位モデルを配る」判断だ、と書きました。あの記事のあと、もう一つ、費用を左右する目盛りが一般化しました。工数(effort)です。同じモデルでも、どれだけ深く考えさせるかをlowからmaxの5段階で指定でき、公式ドキュメントは、モデルを替えるよりこの目盛りを調整するほうが良い手になることが多い、と書いています。
つまり、AIの費用と品質は、いまや2つの目盛りで決まります。どのモデルを選ぶか(品質の天井)と、どれだけ考えさせるか(考える深さ)。この記事では、この2つを1枚のマトリクスに整理し、社内の既定と上限をどう決めるかを、経営が決める3行にまとめます。数字はすべて執筆時点の公式ドキュメントの値で、変わります。
法律事務所にたとえると
外部の法律事務所に仕事を頼む場面を考えます。誰に頼むかで単価が違います。パートナー弁護士、シニア、アソシエイト、パラリーガル。そして、何時間かけてもらうかで請求が変わります。
契約書の雛形の確認をパートナーに20時間かけてもらう会社はありません。逆に、買収の最終交渉をパラリーガルに1時間で、と頼む会社もない。仕事の重さに応じて、誰に、何時間、と決めるのが普通です。
AIも同じ構造になりました。モデルが誰に頼むかに、工数が何時間かけてもらうかにあたります。そして、社内の全員がパートナーを指名して無制限の時間を頼めるようにすると、請求書がどうなるかも、法律事務所の場合と同じです。
2つの目盛りを、正確に押さえる
目盛り1:モデル(品質の天井)
執筆時点の現行モデルと、公式の位置づけ、単価です。
| モデル | 公式の位置づけ | 入力 / 出力(100万トークンあたり) | 工数の指定 |
|---|---|---|---|
| Claude Fable 5.1 | 要求の厳しい推論と、長時間のエージェント作業向け | $10 / $50 | 5段階すべて |
| Claude Opus 5 | 複雑なエージェント型コーディングと企業業務向け。公式は多くの用途でここから始めることを勧める | $5 / $25 | 5段階すべて |
| Claude Sonnet 5 | 速さと知性の最良の組み合わせ | $2 / $10 | 5段階すべて |
| Claude Haiku 4.5 | 最速。近い世代に迫る知性 | $1 / $5 | 非対応 |
補足が2つあります。Sonnet 5の2ドル・10ドルは発売時に8月末までの導入価格とされていましたが、9月1日の値上げは行わず、この価格が標準になったと公式の料金ページに書かれています。もう一つ、Opus 4.7以降のモデルは新しいトークナイザー(文章をトークンに切る方式)を使っており、同じ文章で約3割多いトークンになるそうです。旧モデルと単価だけを比べると、実際の請求の比較を誤ります。
目盛り2:工数(考える深さ)
工数は、応答に使うトークンの量を制御する指定で、公式ドキュメントでは5段階です。既定はhighで、指定しない場合と同じです。
| 段階 | 公式の説明(要約) | 典型的な用途(公式) |
|---|---|---|
| max | 制約なしの最大能力 | 最も深い推論と、最も徹底した分析 |
| xhigh | 長時間の作業に向けた拡張能力 | 30分を超える長時間のエージェント作業やコーディング |
| high(既定) | 高い能力。指定しないのと同じ | 複雑な推論、難しいコーディング、エージェント作業 |
| medium | バランス型。ほどほどのトークン節約 | 速さ・費用・性能のバランスが要る作業 |
| low | 最も効率的。大きな節約と、いくらかの能力低下 | 速さと低コストが要る単純な作業、下請けのエージェント |
注意点も公式に書いてあります。工数は厳密なトークン予算ではなく、振る舞いの信号だということ。低い工数でも、難しい問題ではAIは考えます。ただし同じ問題でも、高い工数より浅く考える。そして工数は、思考だけでなく、文章の長さやツールの呼び出し回数を含む出力全体に効きます。低くすると、ツールの呼び出しが減り、説明が短くなります。
マトリクス。どの仕事を、どこに置くか
2つの目盛りを掛け合わせます。セルの中身は、公式ドキュメントの各モデル向けの推奨を土台に、自分が企業の業務に当てはめたものです。○は向く、△は条件付き、×は向かない(過剰か不足)、の意味です。
| low | medium | high(既定) | xhigh | max | |
|---|---|---|---|---|---|
| Fable 5.1 | × 定型に使う理由がない | △ 対話的に速く回したいとき | ○ 公式の推奨開始点。長い調査、資料を完成まで仕上げる | ○ 何時間も走るエージェント作業 | ○ Opus 5のxhigh以上で足りないときだけ |
| Opus 5 | ○ 費用と速さの主な調整レバー(公式) | ○ 同上。日常の業務文書、分析の下書き | ○ 公式の推奨開始点。複雑な業務、コーディング | ○ 難しいコーディング、エージェント作業 | △ 費用に見合うときだけ |
| Sonnet 5 | ○ チャット、大量処理、応答速度が要る業務 | ○ Sonnet 4.6のhighに相当(公式) | ○ 日常のコーディング、データ分析、文書作成 | △ 最も難しいコーディングのみ | △ まれ |
| Haiku 4.5 | 工数の指定は非対応。定型処理、大量処理、リアルタイム、下請けのエージェント | ||||
単価と各段階の説明は記事末尾の公式ドキュメント(執筆時点)。セルの用途の当てはめは筆者の整理。
表から読み取ることを3つに絞ります。
第一に、左上から右下へ、費用は桁で変わります。Sonnet 5のlowと、Fable 5.1のmaxでは、単価で5倍、使うトークン量でさらに数倍の差が出ます。同じ質問を投げても、請求は10倍を超え得ます。
第二に、公式が勧める昇格の順序があります。モデル選びの公式ガイドによれば、多くの用途はOpus 5から始め、工数を上下に調整し、xhighやmaxでも実測の結果が足りないときにFable 5.1へ移る、という順序です。効率を優先する場合はHaiku 4.5から始めて、足りないときだけ上げる、という逆順も示されています。どちらの順序でも、共通しているのは、実測して足りないときだけ上げる、という点です。
第三に、下げる判断は、上げる判断より難しい。公式は、Opus 5ではlowとmediumを費用と応答時間の主な調整手段として積極的に使え、と書いています。ただし現場は、下げると品質が落ちるのではと不安になり、既定のhighのまま放置します。既定のhighは、多くの定型業務には過剰です。
管理者が使える目盛り
ここまでの話を、会社として効かせる仕組みが2つあります。いずれもClaude Codeの管理者向けドキュメントにもとづきます。
一つは、モデルの制限です。管理設定で、利用者に見せるモデルを絞れます。Enterprise契約でClaudeアカウントにサインインする構成なら、組織の管理画面から個別のモデルを無効にすることもできます。
もう一つは、工数の上限です。9月9日に、Claude Codeの管理設定に、工数の上限を全モデル一括またはモデル別に決める設定(maxEffortLevel)が加わりました。Bedrock、Google、Microsoft経由を含むすべての提供元で効き、利用者は上限より下は選べるが上は選べない、という仕組みです。Enterprise契約なら、役割ごとに工数の上限を決める組織設定もあります。
プランの側にも目盛りがあります。公式のサポートページによれば、Fableは、Max、Team、Enterpriseの上位席では週の利用上限の半分まで追加費用なしで使え、Pro、Team、Enterpriseの標準席では利用クレジット(従量)を別に払う扱いです。全員の席をFable込みにすると席の単価が上がり、標準席のままにすると使った分だけ請求が来る。どちらにするかは、指名制で使わせたい人数で決まります。
なお、Fable 5.1の既定の工数は、公式の発表によれば、Claude Codeではhigh、Coworkとclaude.aiではmediumだそうです。同じモデルでも、入口によって既定が違います。
変化が速い分野です。単価、工数の段階、管理設定は数週間で変わります。この記事の値は執筆時点のもので、社内の既定と上限を決める際は、必ず最新の公式情報を確認してください。
経営が決めること。3行で足ります
モデルと工数の設定は、技術部門が決めればよいように見えて、費用の構造を決める話なので、経営が先に方針を渡すべきものです。指示は次の3行で足ります。
- 既定を決める。全社の既定は、Sonnet 5のhighか、Opus 5のmediumのどちらか。Fable 5.1は指名制で、必要な人と業務だけに渡す。以前の記事で書いた「基盤は標準、上位は指名制」を、工数を含めて決め直す。
- 上限を役割ごとに決める。誰がxhighとmaxを使えるかを決め、管理設定の工数の上限で縛る。Bedrockなどクラウド経由でも同じ設定が効くので、構成によらず一律に決められる。
- 上げる前に測る。同じ業務を、いまの設定と一段上の設定で比べ、差が出たときだけ上げる。公式のガイドも、上げる判断は実測でとしている。測っていない昇格は承認しない。
3行のうち、いちばん抵抗があるのは1です。現場は最上位を既定にしたがります。ただし法律事務所のたとえに戻ると、雛形の確認をパートナーに頼み続ける会社は、いずれ請求書で気づきます。気づく前に決めるのが、経営の仕事です。
結び
モデルと工数の2つの目盛りは、AIの費用を制御できるものに変えました。どちらも動かせる、というのが良い知らせです。悪い知らせは、どちらも既定のまま放置すると、上位モデルにhighで全員が使う状態に自然に落ち着く、ということです。
目盛りは、誰かが決めない限り、高いほうで止まります。
出典(一次情報)
この記事のClaudeの製品と料金に関する記述は、以下の公開情報にもとづいています(いずれも執筆時点で確認)。
- 現行モデルの単価(Fable 5.1 $10/$50、Opus 5 $5/$25、Sonnet 5 $2/$10、Haiku 4.5 $1/$5)、Sonnet 5の導入価格が標準価格になったこと、Opus 4.7以降のトークナイザーで約3割多いトークンになること、バッチ処理の割引:
Pricing ― Claude Platform Documentation - 現行モデルの位置づけ、既定の工数がhighであること、Haiku 4.5は工数に非対応であること:
Models overview ― Claude Platform Documentation - 工数の5段階と各段階の説明、既定がhighで指定しないのと同じこと、工数が厳密な予算ではないこと、出力全体とツール呼び出しに効くこと、各モデル向けの推奨(Opus 5でlow・mediumを主な調整手段とする、Sonnet 5のmediumがSonnet 4.6のhighに相当、Fable 5.1はhighから始める):
Effort ― Claude Platform Documentation - モデルを替えるより工数の調整が良い手になることが多いこと、多くの用途はOpus 5から始めること、xhighやmaxで足りないときにFable 5.1へ移ること、効率優先ならHaiku 4.5から始めること、上げる判断は実測で行うこと:
Choosing the right model ― Claude Platform Documentation - 管理設定によるモデルの制限(availableModels)、工数の上限(maxEffortLevel)が全提供元で効くこと、Enterpriseの組織設定で役割ごとの工数上限を決められること:
Set up Claude Code for your organization ― Claude Code Documentation - Fable 5.1の発表、Claude Codeではhigh、Coworkとclaude.aiではmediumが既定の工数であること:
Introducing Claude Fable 5.1 and Claude Mythos 5.1 ― Anthropic(2026年9月1日) - Fableのプラン別の扱い(上位席は週の上限の半分まで追加費用なし、標準席は利用クレジット):
Claude Fable models on your plan ― Claude Help Center
上記は執筆時点の公開情報です。単価、工数の段階、管理設定は数週間で変わります。社内の既定と上限を決める際は、必ず最新の公式情報をご確認ください。