AI企業のAnthropicが、新しいAIモデル「Claude Opus 5.5」を発表しました。Claude 5.5ファミリーで最初のモデルで、従来のClaude Opus 5から性能や効率、安全性を改善し、一般的な処理ではOpus 5より40%低いコストで利用できるとしています。また、出力速度もOpus 5より30%以上高速化しています。

Introducing Claude Opus 5.5 \ Anthropic

https://www.anthropic.com/claude-opus-5-5

Claude Opus 5.5はAnthropicのOpusシリーズの新モデルで、AIが複数の手順を自律的に進める「エージェント型」の作業で性能が向上しています。

Claude Opus 5.5と主要AIモデルのベンチマーク比較。Opus 5.5は、エージェント型コーディング、知識処理、推論、コンピューター操作、グラフ認識など幅広い項目で高いスコアを記録しています。一方、AutomationBenchやTerminal-Bench-Science 0.1ではGPT-6 AstraがOpus 5.5を上回っています。なお、Anthropicは、高性能なモデル同士ではベンチマーク上のわずかな差が実際の使用感の差を正確に表すとは限らないとも説明しています。



コマンドライン上で複雑な作業を実行する能力を測定する「Terminal-Bench 4.0」では66.4%を記録し、Opus 5の52.3%だけでなく、GPT-6 Astraの57.9%も上回りました。



ソフトウェア開発能力を測る「FrontierCode v1.1」では54.4%、「CursorBench 4.0」では57.8%となっています。



Opus 5.5は大規模なコードベースを長時間処理する作業に重点が置かれており、早期利用者によるテストでは、20万行のコードを監査して修正する作業を3時間未満で完了しました。なお、Opus 5は同じ作業に20時間以上を要し、使用したトークン数もOpus 5.5の約2.5倍でした。

Anthropicによる別のテストでは、ウェブサービスなどで利用されるロードバランサー「HAProxy」をC言語からRustへ書き換える作業を実施しました。Opus 5.5とClaude Fable 5.1はいずれもHAProxyの回帰テストのほぼすべてを通過しましたが、Opus 5.5の作業時間は9.5時間で、Fable 5.1の12時間より短く、コストも51%低かったとのこと。

効率面では、Opus 5.5は1トークン当たりの料金そのものがOpus 5より安くなったことに加え、同じ作業に必要なトークン数も削減されています。効率面では、Opus 5.5は1トークン当たりの料金そのものがOpus 5より安くなったことに加え、同じ作業に必要なトークン数も削減されています。Anthropicによると、標準設定で一般的な処理を行った場合、総コストはOpus 5から40%減少するとのこと。Claude CodeとClaude Platformでは、最大2.5倍の速度で処理する「Fast mode」も利用できます。



価格もOpus 5から引き下げられています。100万トークン当たりの料金は、入力が5ドル(約750円)から4ドル(約600円)、出力が25ドル(約3750円)から20ドル(約3000円)に低下しました。キャッシュへの書き込みも6.25ドル(約940円)から5ドル(約750円)となり、特にキャッシュの読み取りは0.50ドル(約75円)から0.20ドル(約30円)へと60%引き下げられています。



文章生成についても変更が加えられています。Anthropicによると、Opus 5.5は従来モデルより重要な情報を先に提示し、文章を簡潔で追いやすくするよう改善されています。早期利用企業のBoxによる評価では、Opus 5と比べて使用トークン数が約3分の1減少し、回答も精度を落とさず約40%短くなったと報告されています。

安全性については、Anthropicが約2000種類のシナリオを使ってモデルの行動を調べる自動評価で、Opus 5.5は多くの不適切な行動に関する指標で、最近のClaudeモデルの中で最も良い結果を示しました。モデルが与えられた実行環境の境界を越えようとする行動を調べる新しい評価では、Opus 5やClaude Mythos 5.1より、そのような試みが約85%少なかったとしています。また、プロンプトインジェクションへの耐性もOpus 5と同等以上だったと報告されています。

一方でサイバーセキュリティや生物学など悪用された場合の影響が大きい分野では、追加の制限が設けられています。通常のソフトウェア開発でコードのバグを調べたり修正したりすることはできますが、多くのサイバーセキュリティ関連タスクは別のモデルへ振り分けられます。生物学分野についても安全対策が適用され、研究機関や企業などは審査を受けることで、より幅広い研究用途に利用できる「Life Sciences Verification Program」に申請できます。

また、Opus 5.5には大量の偽アカウントなどを利用してモデルの能力を抽出する「蒸留攻撃」への対策として、「preserved thinking」が導入されています。API利用者がClaudeの過去のコンテキストを書き換えて推論情報を取り出そうとする手法を防ぐための仕組みです。

さらに、データ保持とコンプライアンスについては、従来のOpusシリーズと同様に、対象となる利用形態でAnthropicが入力や出力を保持しない「zero data retention」に対応しています。加えて、EUのAI法への対応として、Claude Fable 5.1と同様のウォーターマークも導入されています。また、Opus 5.5では「thinking」モードを無効化して利用することはできなくなっています。

Claude Opus 5.5はすでにAnthropicの各プラットフォームで提供されており、Amazon Web Services、Google Cloud、Microsoft Azureでも利用できます。Claude Platformでは「claude-opus-5-5」というモデル名で提供されています。また、Pro、Max、Team、Enterpriseプランでは5時間ごとの利用上限が引き上げられます。Anthropicは今後数週間以内に「Claude Sonnet 5.5」と「Claude Haiku 5.5」も投入する予定です。