Claude Fable 5.1は、Anthropicの中で最も多才なコーディング、コンピュータ利用、長時間のエージェント作業向けモデルとして位置づけられており、その実力はエージェントベンチマークとタスクあたりのコストで明確に示されています。注目すべきは単なるスコアの向上だけでなく、パフォーマンスとコストのバランスが改善されたことです。実際には、ターミナルエージェント、構造化されたリサーチループ、ブラウザ自動化を運用するチームは、キャッシュ読み取りを活用し、タスクごとに適切な労力レベルを選択することで、より少ないトークンで高い完了率を達成できます。これにより、これまで連続実行が遅すぎたりコストが高すぎたりしたユースケースが実現可能になります。
よく知られた評価指標であるTerminal-Benchのエージェントコーディングバリアント、IDEのようなワークフロー向けのCursorBench、コンピュータ利用のOSWorld、ビジネスタスクのAutomationBench、そして推論のHumanity’s Last Examにおいて、Fable 5.1は概ねOpus 5を上回り、特にツールが有効でタスクが長時間実行される場合にFable 5からの改善が顕著です。このモデルは、多段階チェーンで信頼性を損なうショートカット行動を回避し、検証ループでは症状を覆い隠すのではなく根本原因を特定することが多いです。この信頼性は再実行の減少につながり、大規模にエージェントを運用する際にはリスト価格のトークンと同じくらい重要です。
コスト面でのアップグレードが実際の運用に直結します。Anthropicの安価なキャッシュ読み取りに重点を置いた価格設定と、Fable 5.1の状態再利用能力の組み合わせにより、エージェントのワークロードは計画、コンテキスト、ツールスキーマを再利用可能なメモリにより多く押し込むことが可能です。購入者にとっては、1) 計画と制約をキャッシュされたシステムプロンプトに前倒しで組み込む、2) ルーチンステップのデフォルト労力レベルを下げる、3) 検証ゲートでのみ労力を上げる、4) モデルの探索的呼び出しを減らすためにツールアクセスを制限する、という方法で節約が複利的に増えます。その結果、スループットが向上し、請求額が抑えられ、無人ジョブのSLOが簡素化されます。


