Claude Fable 5.1とは?料金・API変更・移行の注意点を解説

Claude Fable 5.1はキャッシュ読み取りを100万トークンあたり$0.25に引き下げました。一方、強制ツール呼び出しや編集済みの会話履歴はAPIエラーの原因になります。料金、1Mコンテキスト、移行手順、データ保持条件まで、導入前に押さえたいポイントを実務目線で整理します。

Wednesday, September 2, 2026Omid Saffari
Claude Fable 5.1とは?料金・API変更・移行の注意点を解説

Claude Fable 5.1は、長時間動き続けるエージェントを試すうえで有力なモデルです。ただし、あらゆるClaude連携をそのまま置き換えられるアップグレードではありません。Anthropicが2026年9月1日に公開したこのモデルでは、キャッシュ読み取りが100万トークンあたり$0.25になった一方、強制ツール呼び出しや編集済みの会話履歴を使う実装が動かなくなる可能性のあるAPIルールも導入されています。

Claude Fable 5.1とは何か

Fable 5.1が想定しているのは、途中で終わらず長く走り続ける仕事です。たとえば、複数サービスをまたいで障害原因を追うコーディングエージェント、複数の情報源から証拠をたどるリサーチエージェント、大量のファイルを完成済みの成果物にまとめるドキュメントエージェントが該当します。APIのモデルIDはclaude-fable-5-1です。すべてのClaude API顧客に加え、Amazon Bedrock、Claude Platform on AWS、Google Cloud、Microsoft Foundryでも利用できます。

ここで重要なのは、Fable 5.1があくまで「モデル」だという点です。新しいアプリでも、Claude製品全体の後継でもありません。Anthropicは今も、大半のAPI開発者にClaude Opus 5から始めるよう案内しています。要求の厳しい推論や長期タスクが自社のOpus評価を通らない場合に、Fable 5.1へ引き上げる位置づけです。Claude Mythos 5.1は同じ基盤モデルに異なる安全策を適用していますが、承認を受けたProject Glasswing顧客にしか提供されません。Anthropicの現行モデルガイドにも、この区分が明記されています

コンテキストウィンドウは標準で1Mトークン、出力は最大128kトークンです。コンテキストウィンドウとは、現在のリクエストでモデルが使う作業記憶を指します。指示、メッセージ、ファイル、ツール、実行結果、思考、生成中の回答まで、すべてがここに含まれます。100万トークンあれば大量の情報を保持できますが、すべてのトークンが有効に働くわけではありません。Anthropic自身もコンテキストガイドでcontext rotに注意を促しており、不要な情報が積み重なるほど想起精度や正確性が低下する可能性があります。

Adaptive thinkingは常に有効です。モデルにどこまで処理させるかは、lowmediumhighxhighmaxという5段階のeffortで調整できます。まずはAPIのデフォルトであるhighから始めてください。推論内容が表示されなくても思考トークンは出力として課金されるため、評価結果を維持できると確認できた場合に限り下げるのが安全です。

この記事はAPI開発者向けの解説です。Claudeをチャットで使うだけなら、依頼するタスクの結果が改善する可能性はありますが、利用者側で移行作業を行う必要はありません。

Claude Fable 5.1の料金変更は小さくも大きい

Fable 5.1は、すべての料金が下がったわけではありません。基本の入力・出力単価はFable 5から据え置きで、どちらもOpus 5の2倍です。大きく変わったのは、同じコンテキストを繰り返し使う場合の料金です。

モデル入力(1Mトークンあたり)キャッシュ読み取り(1Mトークンあたり)出力(1Mトークンあたり)コンテキスト
Claude Fable 5.1$10$0.25$501M
Claude Fable 5$10$1$501M
Claude Opus 5$5$0.50$251M

プロンプトキャッシュは、システム指示、ツール定義、リポジトリ構成、文書一式など、処理済みのプレフィックスを保存する仕組みです。次のリクエストがまったく同じプレフィックスから始まれば、Claudeは入力単価を満額払って再処理せず、キャッシュ済みの内容を読み取れます。

1Mトークンのプレフィックスを10回読み取る場合を考えてみます。Fable 5のキャッシュ読み取り料金は$10ですが、Fable 5.1なら$2.50です。新しい入力や出力を除いても、同じコンテキストの反復だけで$7.50、率にして75%を節約できます。Anthropicは、2026年8月の利用状況を4週間分析した結果として、トークン従量制の一般的なワークロードでは総額が約25%、エージェント性の高いワークロードでは最大約45%下がると見積もっています。これはベンダー側の試算ですが、その根拠となる単価は明確です。現行の料金表には、キャッシュ処理ごとの単価が掲載されています

粘土風の運河閘門でコストを比較した図。100万トークンのキャッシュ済みプレフィックスを10回読み取ると、Fable 5では10ドル、Fable 5.1では2ドル50セントかかる
Fable 5.1では同じプレフィックスを繰り返し読む費用が75%下がりますが、新規入力や出力の単価は下がりません。

ただし、注意点があります。5分キャッシュへの書き込みは100万トークンあたり$12.50、1時間キャッシュでは$20です。デフォルトの有効期間は5分です。プレフィックスは最低512トークン必要で、内容が完全に一致していなければなりません。また、並列で送った後続リクエストがキャッシュを使うには、最初のレスポンス生成が始まっている必要があります。Anthropicによると、5分の設定は1回読み取れば元が取れ、1時間の設定は2回で回収できます。キャッシュが効いたと思い込まず、cache_creation_input_tokenscache_read_input_tokensinput_tokensを確認してください。

短い単発プロンプト、プレフィックスが毎回変わる処理、コストの大半が出力に偏るエージェントでは、この変更の効果はほとんどありません。出力は100万トークンあたり$50なので、不要な思考や長すぎる回答が、引き続き請求額の中心になり得ます。

公開時のベンチマークは期待を持たせる内容ですが、それだけで購入を決めるべきではありません。Anthropicの報告では、Terminal-Bench 4.0でFable 5.1が55.8%、Fable 5が42.0%、AutomationBenchではそれぞれ31.4%と17.1%でした。ただし、いずれもAnthropicの本番用安全策を適用し、ベンダー自身が実施したテストです。すべてのワークロードが改善する証明ではなく、自社タスクで評価を行うきっかけとして捉えてください。公開レポートにはテスト条件と比較結果が掲載されています

Claude Fable 5.1が向いている人と使い方

1つの難しいリポジトリ作業を抱える個人開発者

すべてのコーディング作業をFable 5.1へ移す必要はありません。日常的な修正には、すでに品質基準を満たしているモデルを使い続け、複数サービスにまたがる移行、根本原因の調査、大規模なコードベース全体から判断をつなぎ合わせるレビューなど、手強い仕事だけをFableへ振り分けます。安定したリポジトリ指示とツール定義はキャッシュしてください。小さな作業すべてにFableの料金を払わずに、高コストな仕事の成功率を高められます。

ツールループを本番投入するエージェント基盤エンジニア

必要なのはモデルの切り替えだけではありません。エージェントランナーがツール利用を強制していないか、最上位のシステムプロンプトを書き換えていないか、ツール配列を変更していないか、過去のメッセージを削除していないか、後続の思考ブロックを残したままクライアント側の要約へ差し替えていないかを監査してください。どのパターンも、通常のセッションを400エラーへ変える可能性があります。目指すのは見栄えのよいデモではなく、ターンを重ねても壊れないロールアウトです。

大量のファイルを横断するリサーチ責任者

1Mという数字が使えるという理由だけでなく、長い記録から本当に関係性を見つけ出す必要がある場合にFable 5.1を選びます。まずhigh effortで実行し、既知の結果と照らして回答を採点してから、mediumまで段階的に下げてください。Anthropicは、mediumなら低コストでFable 5とほぼ同等になると説明しています。ただし、そのトレードオフが成立するかは、自社の検索精度と引用の検証結果で判断すべきです。

エンタープライズのセキュリティ/データ責任者

性能を見る前に、ポリシーを確認してください。Fable 5.1はCovered Modelに該当し、30日間のデータ保持が必要です。Anthropicが明示的に許可しない限り、ゼロデータ保持では利用できません。また、Priority Tierにも対応していません。どちらかが譲れない条件なら、その時点で評価を打ち切り、要件を満たすモデルをルーティングに残してください。

Claude Fable 5.1へ安全に移行する方法

最小限のAPI呼び出しは簡単です。本番移行では、次の4項目を確認する必要があります。

  1. 実際のタスクで基準値を取る

    現在のモデルで代表的な同一タスクを実行し、タスクの成否、所要時間、入力、キャッシュ作成、キャッシュ読み取り、出力、拒否の有無を記録します。簡単な試し用プロンプトではなく、Fableの高い単価を払う価値がある仕事を選んでください。

  2. 固定したモデルをhigh effortで呼び出す

    APIキーを設定し、最新版のPython SDKをインストールしたうえで、Pythonコードをtest_fable.pyとして保存します。

    Bash
    python3 -m venv .venv
    source .venv/bin/activate
    pip install anthropic
    export ANTHROPIC_API_KEY="your-api-key-here"
    Python
    import anthropic
    
    client = anthropic.Anthropic()
    
    message = client.messages.create(
        model="claude-fable-5-1",
        max_tokens=4096,
        output_config={"effort": "high"},
        messages=[
            {
                "role": "user",
                "content": "Map the risks in moving this service from SQLite to PostgreSQL.",
            }
        ],
    )
    
    for block in message.content:
        if block.type == "text":
            print(block.text)
    
    print(message.usage.model_dump_json())

    python test_fable.pyで実行します。この例は、Anthropicの現行SDKとeffortの構文に沿っています。本番用プロンプトには、実際の評価タスクを使ってください。

  3. 互換性を壊す2つのパターンを取り除く

    リクエスト内でtool_choiceanyまたは特定のtoolに設定されていないか検索してください。どちらも現在はHTTP 400を返します。設定はautoのままにし、正しい引数を必須にしたい場合はツールスキーマへstrict: trueを指定します。そのターンで必要なツールは、モデルへの指示で明示してください。

    次に、履歴を追記専用にします。思考ブロックを含め、返されたアシスタントターンは変更せず、そのまま再送してください。新しい指示は会話途中のシステムメッセージとして追加します。以前のターンを書き換える代わりに、サーバー側のcompactionまたはcontext editingを使ってください。

  4. トラフィックを流す前に診断を有効化する

    ベータヘッダーthinking-binding-controls-2026-08-01prefix_mismatch_behavior: "drop_block"を指定し、通常の複数ターンセッションを実行します。input_transformationsをログに残してください。prefix_binding_mismatchが出た場合、連携側で履歴が変更されています。古いモデルへルーティングした後にmodel_binding_mismatchが出るのは想定どおりです。

    履歴が安定したら、512トークン以上の再利用可能なプレフィックスを持つリクエストに、最上位のcache_control: {"type": "ephemeral"}を追加します。後続リクエストでcache_read_input_tokensが0を上回ることを確認してください。

現実的な注意点:安いコンテキストと引き換えに状態管理は厳格化

Fable 5.1では、各思考ブロックが、その前にあるシステムプロンプト、ツール、メッセージへひも付けられます。2026年8月31日以降に作成されたアカウントでは、このプレフィックスを変更してからブロックを再送すると、The block is bound to a different conversationというエラーになります。それ以前のアカウントでも同じ検証を今すぐ有効にできます。Anthropicは、今後のモデルでこの仕組みをさらに広く適用するとしています。

粘土風の会話フロー図。追記専用のターンは正常な出力へ進み、過去のターンを書き換えた経路は400エラーとベータ版のdrop-block回避策へ分岐する
Fable 5.1のエージェント履歴は追記専用が基本です。過去を書き換えると、その後の思考ブロックがすべて無効になる可能性があります。

エラーにならなくても、モデルの動作は変わります。暗黙的なエージェントループでは、Fable 5が複数のツール呼び出しをまとめていた場面でも、1回ずつ呼ぶことがあります。進捗報告は少なくなり、low effortでは検索頻度が下がり、文章が密になりやすく、小さな修正でもファイル全体を書き換える場合があります。キャッシュ単価が下がっても、こうした変化によってターン数、遅延、出力量が増える可能性があります。Anthropicは動作ごとのプロンプト改善策を公開していますが、重視する動作を測る評価は自社で用意する必要があります。

128k出力という仕様にも、もう1つ上限があります。max_tokensが21,333を超える場合、SDKではストリーミングが必須です。思考も同じ出力枠を消費するため、high effortのリクエストでは、見える回答が始まる前にその大部分を使う可能性があります。本当に難しい仕事には余裕のある上限を設定すべきですが、大きな上限を目標値と取り違えないでください。

Claude Codeの利用者は、連携側で行う作業が少なくて済みます。Version 2.1.257では、2026年9月1日からFable 5.1がデフォルトのFableモデルになりました。それでも利用量を監視し、差分を確認し、成果が単価に見合う仕事へ限定して使う必要があります。Claude Codeの変更履歴にモデル切り替えが記録されています

今、Claude Fable 5.1を導入すべきか

長時間動くFable 5エージェントをすでに運用し、安定したコンテキストを繰り返し送り、データ保持条件を受け入れられるなら、今週中に動き始める価値があります。Fable 5.1へ少量のトラフィックだけを振り分け、履歴診断を実行し、強制ツール指定を置き換えたうえで、mediumhigh effortのタスク成功あたりコストを比較してください。

Opus 5や現在のモデルですでにワークロードを処理できている場合、ほとんどが単発呼び出しの場合、代表的な評価タスクがない場合は待つべきです。Fableの基本入出力料金は、今もOpus 5の2倍です。キャッシュ単価が下がっても、不適切なルーティング判断までは解決できません。

Claudeをチャットで使うだけでAPI連携を管理していない人には、影響はありません。モデル選択は製品に任せ、結果で判断してください。通常のゼロデータ保持またはPriority Tierが必須の企業も、Anthropicから書面による許可を得ない限り、要件を満たすルートを維持すべきです。

次回のリリースも実装判断に使える形で読みたい方は、ニュースレターにご登録ください

最終更新

2026年9月2日

カテゴリーExplained

Googleでこのサイトを優先する

omidsaffari.comをGoogle検索の優先ソースに追加

omidsaffari.comを優先ソースに設定すると、GoogleがTop Stories・AI Overviews・AI Modeであなたのために優先表示します。

Explainedの他の記事

Explainedの記事をすべて見る
ニュースレター

毎週日曜、一通の手紙。 動くシステムの話。感想戦ではなく。

AIベンチャーのポートフォリオ運営から生まれるビルドログ、稼働中のシステム、現場ノート。

週刊。スパムなし。いつでも解除できます。