Claude Opus 5.5は「半額のFable」か──Fable 5.1並みの性能で、同じ仕事が約半分のコスト・8割の時間。うれしい一方で、Fableの立場はどうなる

テクノロジー

2026年9月22日、AnthropicがClaude Opus 5.5を発表しました。発表文の冒頭には、こうあります。

ほとんどの仕事でClaude Fable 5.1の水準の性能を出し、Opus 5より40%安く動く(発表文冒頭、拙訳)

Fable系は賢い。でも、クレジット(利用枠)の減りが激しく、推論にも時間がかかる。これが私のFable系に対する率直な印象です。そのFable並みが、Opusの値段で手に入るなら、ユーザーとしてはこれ以上うれしい話はありません。

ちなみにこの記事の下書きは、発表翌日のOpus 5.5で動くClaude Codeが書いています。自分の発表記事を自分で要約させるのは少々気が引けますが、数字は発表ページとAnthropicの料金ページから転記させ、私の理解とズレているところは指摘させました。

先に結論です。

  • 性能はFable 5.1並み。 発表のベンチマーク9項目すべてで、Opus 5.5がFable 5.1を上回っています。ただしAnthropic自身が「実際の差はスコアほど大きくない」と書いており、「同等」と読むのが素直です
  • コストと時間は、Fableより明確に軽い。 API単価はFable 5.1の4割(入力$4/出力$20)。同じ移植作業の実例で、Fableより21%速く、コストは51%少なく終わっています
  • Sonnet 5.5とHaiku 5.5も数週間以内に来る。 賢いモデルが指揮を執り、安いモデルに仕事を振る形が、いよいよ現実的になりそうです
  • 一方で、Fableを選ぶ理由が見えにくくなりました。 Fableの大型アップデートに期待します

まず、数字をどうぞ

Opus 5.5とFable 5.1を並べると、性能は並び、単価は4割、実作業のコストは約半分。財布にやさしいOpusです
Opus 5.5とFable 5.1を並べると、性能は並び、単価は4割、実作業のコストは約半分。財布にやさしいOpusです

発表ページのベンチマーク表から、Opus 5.5・Fable 5.1・Opus 5の3つを抜き出しました。

ベンチマーク分野Opus 5.5Fable 5.1Opus 5
Terminal-Bench 4.0エージェント型コーディング66.4%55.8%52.3%
FrontierCode v1.1エージェント型コーディング54.4%50.3%48.0%
CursorBench 4.0エージェント型コーディング57.8%51.8%46.6%
GDPval-AA v2.1(Elo)知的労働184617351708
AutomationBench業務ワークフロー40.0%31.4%26.9%
Humanity’s Last Exam(ツールあり)分野横断の推論67.7%65.6%63.6%
Terminal-Bench-Science 0.1エージェント型の科学研究58.7%52.6%29.0%
OSWorld 2.0(部分)コンピューター操作81.8%80.7%74.0%
Chartography(ツールあり)グラフの読み取り89.0%88.4%83.4%
9項目すべてでOpus 5.5(濃い色)がFable 5.1を上回っています。差が大きいのはコーディングと業務系、小さいのはコンピューター操作とグラフ読み取り
9項目すべてでOpus 5.5(濃い色)がFable 5.1を上回っています。差が大きいのはコーディングと業務系、小さいのはコンピューター操作とグラフ読み取り

見てのとおり、9項目すべてでOpus 5.5がFable 5.1を上回っています。 差が大きいのはTerminal-Bench 4.0(+10.6ポイント)とAutomationBench(+8.6ポイント)、ほぼ横並びなのはOSWorld 2.0(+1.1)とChartography(+0.6)です。

ただし、読むときの注意が3つあります。

  • Anthropic自身が「差はスコアほどではない」と書いている。 発表文には、この性能域ではベンチマークの差が実際の差の指標として当てにならなくなってきた、社内で使った感触ではOpus 5.5とFable 5.1の差はスコアより小さい、とあります。発表文の一行目も「ほとんどの仕事で」Fable 5.1と同じ水準、です。「Fableを超えた」ではなく「Fable並み」と読むのが、Anthropicの説明に沿った読み方です
  • 表のOpus 5.5は、原則として最大の思考量(effort max)で測った値。 Terminal-Bench 4.0だけはxhighです。既定のeffortはmedium(中)なので、普段使いの設定でこのスコアがそのまま出るわけではありません
  • 他社モデルに負けている項目もある。 表にはOpenAIのGPT-6 Astraも載っていて、AutomationBench(41.4%)とTerminal-Bench-Science(64.6%)ではAstraがOpus 5.5を上回っています

コスト:単価はFableの4割、実作業では約半分

料金はAnthropicの料金ページ(API、100万トークンあたり)から。比較用にSonnet 5とHaiku 4.5も並べました。

モデル入力出力キャッシュ読み出し
Fable 5.1$10$50$0.25
Opus 5.5$4$20$0.20
Opus 5$5$25$0.50
Sonnet 5$2$10$0.20
Haiku 4.5$1$5$0.10
100万トークンあたりの出力単価。Opus 5.5はFable 5.1の4割、Sonnet 5のちょうど2倍。キャッシュ読み出しに限ると、Opus 5.5とSonnet 5は同じ値段です
100万トークンあたりの出力単価。Opus 5.5はFable 5.1の4割、Sonnet 5のちょうど2倍。キャッシュ読み出しに限ると、Opus 5.5とSonnet 5は同じ値段です

入力・出力の単価は、Opus 5.5がFable 5.1のちょうど4割です。Opus 5と比べても2割安く、キャッシュ読み出しは6割安くなりました。発表文によると、キャッシュ読み出しはエージェント型の作業やコーディングの費用の大半を占め、既定設定の一般的な作業ではOpus 5より4割安くなるとのこと。

実作業の例も1つ載っています。HAProxy(Webの負荷分散で広く使われるソフト)をC言語からRustに書き直させる社内テストで、Opus 5.5とFable 5.1の両方に同じ仕事をさせた結果です。

  • 仕上がり: どちらもHAProxy自身の回帰テストをほぼすべて通過
  • 時間: Opus 5.5は9.5時間、Fable 5.1は12時間
  • コスト: Opus 5.5はFable 5.1より51%少ない

単価は4割なのに、実作業のコスト差が「約半分」に留まるのは、キャッシュ読み出しの単価が$0.20と$0.25でほとんど変わらないからだろう、とClaudeは見ています。エージェント作業の費用の大半がキャッシュ読み出しなら、そこの差が小さい分だけ、全体の差も縮みます。それでも、同じ仕事が半額で、2時間半早く終わる。私にとっては十分すぎる差です。

速度:Opus 5より3割速い

速度の数字は、発表文に次の3つがあります。

  • 出力速度はOpus 5より30%以上速い
  • コマンドライン系の公開ベンチマークで、Opus 5より多く解きながら、ツール呼び出しは約4割少なく、トークンは半分
  • Fastモードは最大2.5倍速(Claude CodeとAPIで利用可。単価は入力$8/出力$40と倍になります)

「推論時間が長い」というFable系への不満にも、HAProxyの例(12時間 → 9.5時間)が答えています。待ち時間が2割縮むのは、毎日使う道具としては地味に大きい。

そしてサブスクリプション(Pro、Max、Team)の利用者には、もう1つうれしい話があります。5時間ごとの利用上限が引き上げられました。 単価が下がって上限が上がる。クレジットの減りに一喜一憂してきた身には、ありがたい話です。

Sonnet 5.5とHaiku 5.5も来る:賢いモデルが指揮を執る時代へ

発表文の最後に、Claude Sonnet 5.5とClaude Haiku 5.5が「数週間以内に」続くとあります。性能・効率・安全性の改善の多くを引き継ぐそうです。

私が期待しているのは、賢いモデルがエージェントの指揮役(コントローラー)になり、タスクの難しさに合わせて、クレジットの消費が小さいモデルに仕事を振る形です。簡単な下調べや定型作業はHaikuに、そこそこの判断が要る仕事はSonnetに、全体の設計と最後の確認はOpusに。これが自動でうまく回るなら、ユーザーが何もしなくてもコスパが最適化されます。

発表文にも、その方向を後押しする一文があります。Opus 5.5は「サブエージェントへの仕事の振り分けが格段にうまくなり、自分の仕事を工夫して確かめる」。どのモデルに振るかまでは書かれていませんが、指揮役としての腕は上がっているようです。

この形がうまくいくことは、私のブログの実験でも片鱗が見えています。ハーネス編では、ガイドラインの要点を依頼文に足しても0/3だったローカルのQwen3.6が、Claudeが設計した段取りに沿わせると3/3まで上がりました。検品編では、Qwen3.6に二択の検査を104問させたところ、Claudeの判定と98%一致しました。賢いモデルが段取りを組めば、安いモデルでも仕事になる。クラウドの中でOpus・Sonnet・Haikuが同じことをやってくれるなら、話はもっと簡単です。

ただし、下書きの段階でClaudeから1つ指摘がありました。

  • キャッシュ読み出しの単価は、Opus 5.5とSonnet 5で同じ$0.20。 安いモデルに振って下がるのは主に出力と、キャッシュに乗らない入力の分です
  • キャッシュはモデルごとに別。 別のモデルに仕事を振ると、そのモデルは文脈を一から読み直し、キャッシュも一から作ります

エージェント作業の費用の大半がキャッシュ読み出しだとすると、モデルを混ぜて得する分は、定価の比率から想像するより小さくなりうる、というのがClaudeの指摘です。「Opus 5.5のeffortを下げて使う」のと「Sonnetに振る」のと、どちらが安いかは作業次第で、1タスクあたりの費用を測って決めるしかない、ともClaudeは言います。Sonnet 5.5とHaiku 5.5の値段は、まだ発表されていません。

一方で、Fableの立場は

うれしい話ばかりではありません。気になるのはFableの位置づけです。

これまでの整理は分かりやすかった。最高性能ならFable、日常の本命はOpus、軽い仕事はSonnetとHaiku。ところがOpus 5.5がFable 5.1並みの性能を、4割の単価・8割の時間で出してしまうと、Fableを選ぶ理由を、今回の発表から見つけるのは難しくなります。 発表文の「ほとんどの仕事で」の「ほとんど」に入らない仕事が何なのかは、書かれていません。

安全面でも、Opus 5.5はFableと同じ扱いになりました。生物学とサイバーセキュリティの能力がClaude Mythos 5.1に並ぶため、Fable 5.1と同等の安全策を付けて提供するそうです。その結果、日常の開発の中でバグを見つけて直すのは問題ないものの、サイバーセキュリティ系のタスクの多くはOpus 4.8に回されるとのこと。LM Studioの安全性調査のような記事を書く身としては、ここは覚えておきたい点です。

OpusがFableに追いついた今、Fableには「さすがFable」と言わせる大型アップデートを期待したいところです。上がいてこそ、Opusの「半額でFable並み」がありがたく感じられるのですから。

人間がやったこと、Claudeに任せたこと

人間(私)Claude(Claude Code、Opus 5.5)
記事で言いたいこと(4点)を決めた発表ページと料金ページを読み、数字を転記した(表は2回取得して一致を確認)
「Fable並みならうれしい」「指揮役に期待」「Fableの立場」という評価を決めた私の理解と発表内容のズレを指摘した
公開するかどうかを決める下書きと図(3枚)を作った
キャッシュ単価と、モデルを混ぜたときの費用について指摘した

まとめ

  • Opus 5.5は、発表のベンチマーク9項目すべてでFable 5.1を上回った。 ただしAnthropic自身が「実際の差はスコアほどではない」としており、「Fable並み」と読むのが妥当
  • 単価はFable 5.1の4割(入力$4/出力$20)。 移植作業の実例では、Fableより2.5時間早く、コストは51%少なく終わった
  • Sonnet 5.5とHaiku 5.5も数週間以内に来る。 賢いモデルが指揮を執り、安いモデルに振る形に期待。ただしキャッシュ単価の差は小さく、得をするかは測って決める
  • Fableの立ち位置は、今回の発表からは見えにくくなった。 大型アップデートに期待

「高いけど賢い」から「安くて賢い」へ。ユーザーとしては、この流れを歓迎しない理由がありません。Sonnet 5.5とHaiku 5.5の登場を楽しみに待ちましょう。

Fableよ、Opusの背中が近いぞ。

コメント

タイトルとURLをコピーしました