「Claude Sonnet 5.5」が登場、前モデルより30%高速・30%安価でGPT-6 Solより高性能

AnthropicがAIモデル「Claude Sonnet 5.5」をリリースしました。前世代モデルのClaude Sonnet 5と比べて性能が向上しつつ30%の高速化も達成しているとのこと。ベンチマークテストではGPT-6 Solのスコアを上回っています。
Introducing Claude Sonnet 5.5 \ Anthropic
https://www.anthropic.com/claude-sonnet-5-5
「Claude Sonnet 5.5」「Claude Sonnet 5」「Claude Opus 5.5」「GPT-6 Sol」の各種ベンチマーク結果を並べた表が以下。Claude Sonnet 5.5はすべてのテストで前世代モデルのClaude Sonnet 5を上回り、知識労働や図表理解性能ではGPT-6 Solを超えるスコアを記録しました。

以下のグラフは「Claude Sonnet 5.5」「Claude Opus 5.5」「Claude Sonnet 5」「GPT-5.6 Sol」でエージェント性能ベンチマーク「Terminal-Bench 4.0」を実行した結果を示しており、横軸がタスクごとのコスト、縦軸がスコアを示しています。Claude Sonnet 5.5はGPT-5.6 Solを上回っただけでなく、上位モデルのClaude Opus 5.5と同等の性能を示しました。

Claude Sonnet 5.5はClaude Sonnet 5と比べて30%高速化しており、ほとんどのタスクで30%低コストになるとのこと。以下のパズルキューブを解く動画では、Claude Sonnet 5.5の方が高速かつ安価に処理を終えています。
Sonnet 5.5 is smarter, more efficient, and 30% faster than Sonnet 5. It costs up to 30% less for most work, so your Claude Code usage goes further too.
Use it for well-scoped everyday tasks like fixing bugs and quickly iterating on features. https://t.co/8eFe0YuAJW pic.twitter.com/hSlp8eClQS— ClaudeDevs (@ClaudeDevs) September 28, 2026
Anthropicは先行体験ユーザーによるClaude Sonnet 5.5活用例を以下のスレッドで公開しており、「落葉シミュレーター」「3Dモデル設計」「JavaScriptでのアニメーション作成」といった実例を確認できます。
A thread of early experiments with Claude Sonnet 5.5.
A fall foliage simulator by @_re_pete, made with Sonnet 5 vs Sonnet 5.5. pic.twitter.com/bVbUmS7tSw— Claude (@claudeai) September 28, 2026
第三者機関のArtificial AnalysisもClaude Sonnet 5.5のテスト結果を公開しています。複数のテスト結果をもとにモデルの総合的な性能指標を算出するArtificial Analysis Intelligence Index v4.3.2のスコアは「56」で、フラッグシップモデルのClaude Fable 5.1を3ポイント上回りました。

一方で、推論レベルをMaxにした際のトークン使用量の多さも指摘されています。以下のグラフはArtificial Analysisによるテスト中のタスク当たりのトークン使用量を示しており、Claude Sonnet 5.5がClaude Opus 5.5より多くのトークンを使用していることが分かります。

以下のグラフは横軸がタスク当たりのコスト、縦軸が性能スコアを示しており、Claude Sonnet 5.5がClaude Opus 5.5と比べて「低性能かつ高価」であることが分かります。同一トークン当たりの料金はClaude Opus 5.5よりClaude Sonnet 5.5の方が安価ですが、推論レベルMaxではトークン使用量の多さによってコストが逆転した形です。

Anthropicは「大規模なプロジェクトではOpusを使い、品質・速度・コストのバランスを求める場合はSonnetを使うことを推奨します」「Sonnetの推論レベルをMaxに設定すると、バランスが失われる場合があるため、その場合はOpusの使用を検討することを推奨します」と案内しています。
We recommend starting with Opus for large projects and Sonnet for tasks where you need to balance quality with speed and cost. Claude apps default to medium effort, while Platform is at high. Cranking Sonnet to max loses some of the balance (and you might want to consider Opus).— ClaudeDevs (@ClaudeDevs) September 28, 2026
Claude Sonnet 5.5はすでにAnthropicの各種サービスで使用可能。無料プランのデフォルトモデルもClaude Sonnet 5.5に切り替わっています。

API料金はClaude Sonnet 5と同一です。100万トークン当たりの料金はキャッシュ読み込みが0.2ドル(約31.5円)、キャッシュ書き込みが2.5ドル(約393円)、入力が2ドル(約315円)、出力が10ドル(約1574円)です。
Claude Sonnet 5.5にはFableシリーズやOpusシリーズと同様のセーフガードが適用されており、サイバー攻撃などに関連する危険な内容と判断された会話は処理が中断されて他のモデルにフォールバックされます。
On our automated behavioral audit, Sonnet 5.5 improves on or matches Sonnet 5 on most measures of alignment and honesty.
It’s also the first Sonnet model with cyber safeguards and fallbacks like those on our most capable models. Routine software development is unaffected.— Claude (@claudeai) September 28, 2026
なお、Claude Haiku 5.5が今後数週間以内に登場することも予告されています。
