長時間のコーディングや調査をAIに任せるとき、性能と料金のバランスが気になります。Anthropicは2026年9月22日(米国時間)、新ファミリー「Claude 5.5」の最初のモデルとしてClaude Opus 5.5を発表しました。
公式の一文ははっきりしています。多くの作業でClaude Fable 5.1級の性能を出しつつ、Opus 5より運用コストが約40%安い(典型的なワークロードの試算)という位置づけです。本稿は公式発表ページと開発者向けドキュメントをもとに整理します。
何が新しいか
Opus 5.5は、エージェント型のコーディングや知識労働向けのアップグレードです。公式が挙げる改善は大きく次のとおりです。
- 性能:Opus 5から大きく上がり、初期テスターは複雑な仕事で大きな差を感じた、と紹介されています。
- 安全:自動化された行動監査で、同社がこれまで測った中で最も良い成績。プロンプト注入への耐性もOpus 5より強い、とあります。
- 料金と速度:提供コストが下がった反映として単価が下がり、出力生成はOpus 5より30%以上速い、と公式は述べています。
- 書き方:文章がより自然で、要点が先に来る、というフィードバックが多かった点への改善。
あわせて、CEOが「フロンティアのペース調整」を訴えたあとの最初のモデルリリースである点も、公式は明示しています。外部評価者(Frontier DesignやMETRなど)による事前テストも行った、とあります。
Fable 5.1級という公式の見方
「Fable 5.1並み」は、多くの実務タスクでの体感・位置づけの話です。ベンチマークでは項目によってOpus 5.5がFable 5.1を上回る数字も並びますが、公式自身が「この水準では点数の差だけでは実世界の差が読みにくい」「社内利用ではFable 5.1との差は数字が示すほど大きくない」とも書いています。
公式表から抜粋した目安は次のとおりです(条件・脚注あり。詳細は公式ページを参照)。
| 指標 | Opus 5.5 | Fable 5.1 | Opus 5 |
|---|---|---|---|
| Terminal-Bench 4.0 | 66.4% | 55.8% | 52.3% |
| CursorBench 4.0 | 57.8% | 51.8% | 46.6% |
| GDPval-AA v2.1(Elo) | 1846 | 1735 | 1708 |
| 入力/出力(100万トークン) | $4 / $20 | (Fableは別表) | $5 / $25 |
| キャッシュ読み取り | $0.20 | — | $0.50 |
たとえばTerminal-Bench 4.0ではOpus 5.5が66.4%、Fable 5.1が55.8%。一方、ZapierのAutomationBenchや科学研究向けTerminal-Bench-Scienceでは、GPT-6 Astraの方が高い数字も示されています。入口としては「コーディング/エージェント/知識労働で前線級」「科学や一部自動化ベンチでは他社が強いこともある」と読むとバランスが取れます。
料金と使い始め方
APIの標準単価は入力100万トークンあたり4ドル、出力20ドルです(Opus 5の5ドル/25ドルから約20%減)。エージェントやコーディングで重くなりやすいキャッシュ読み取りは0.20ドルで、Opus 5の0.50ドルから約60%減。これらと「タスクあたりのトークン使用が減る」ことを合わせて、典型利用で約40%安くなる、というのが公式の試算です。
Claude CodeとClaude Platform向けには、最大約2.5倍速の高速モードもあり、入力8ドル/出力40ドルと案内されています。Pro/Max/Team/シート制Enterpriseでは5時間あたりの利用上限も引き上げ、リセットを好きなタイミングで使えるようにした、ともあります。
モデルIDは claude-opus-5-5。Claude APIのほか、AWS(Bedrockなど)、Google Cloud、Microsoft Azure/Foundryでも利用できる、と公式は述べています。数週間以内にSonnet 5.5とHaiku 5.5も続く予定です。
安全まわりの注意
生物学・サイバーなどでMythos 5.1に近い能力があるため、Fable 5.1と同クラスのセーフガードを付けて出している、と公式は説明しています。日常のバグ修正はできる一方、多くのサイバー作業はOpus 4.8へ振り替えられる、といった制限があります。研究用途ではLife Sciences Verification Program、防御側向けにはCyber Verification Programの拡大が案内されています。
Fable 5.1で導入された「preserved thinking」(蒸留対策)も適用されます。開発者向けドキュメントでは、thinkingの無効化不可など、Opus 5からの破壊的変更も並ぶため、移行時は「What’s new」と移行ガイドの確認が必要です。
まとめ
Claude Opus 5.5は、多くの作業でFable 5.1級をうたいつつ、典型的な運用ではOpus 5より安く・速く使えることを前面に出したモデルです。ベンチでは項目差があり、公式も「点数=体感差」ではないと釘を刺しています。
長いコーディングや調査をコスト意識で回したい人は、まず claude-opus-5-5 を試し、セーフガードやAPIの破壊的変更だけ先に確認するのが安全です。詳細はAnthropic公式発表を参照してください。
参考リンク
- Anthropic:Introducing Claude Opus 5.5
- Claude Docs:Claude Opus 5.5 overview
- Claude Docs:What’s new in Claude Opus 5.5
- Anthropic:Claude Opus 5.5 System Card(PDF)

コメント