Anthropic、生成AIモデル「Claude Sonnet 5.5」発表
アメリカのAnthropicは2026年9月28日(日本時間9月29日)、Claude 5.5ファミリーの新モデル「Claude Sonnet 5.5」を発表しました。前世代のSonnet 5と比べて処理速度が30%以上向上した他、1タスクあたりのコストを最大30%削減しています。
性能とベンチマーク
Sonnet 5.5はコーディングや日常的な業務タスクで前世代から大幅に性能がアップしており、一部の評価では上位モデルのOpus 5.5に近い数値を記録しています。
・エージェント型コーディング評価のTerminal-Bench 4.0で70.6%を記録しています。(Sonnet 5は10.3%、Opus 5.5は66.4%)
・実際のCursorセッションに基づくCursorBench 4.0で55.5%を達成(Opus 5.5の57.8%に迫る水準)
・44の職業にまたがる実務タスク評価のGDPval-AA v2.1で1844点を記録(Opus 5.5の1846点とほぼ同水準)
・コンピュータ操作ベンチマークのOSWorld 2.1で80.1%を達成(Sonnet 5は57.0%)
・グラフ認識評価のChartographyで61.6%を記録(Sonnet 5の15.6%から大幅向上)
長時間のタスク処理や画像認識能力も強化しており、スクリーンショットの情報のみを手がかりに「ポケットモンスター 赤」をクリアした初のSonnetモデルとなっています。
コストと処理速度
APIのトークン単価自体はSonnet 5から据え置きですが、同一タスクをこなすために消費するトークン数が減少した結果、タスクあたりの実質コストが最大30%低下しています。
・入力トークン:100万トークンあたり2ドル
・出力トークン:100万トークンあたり10ドル
・キャッシュ読み取り:100万トークンあたり0.20ドル
・キャッシュ書き込み:100万トークンあたり2.50ドル
また、出力生成の速度はSonnet 5と比べて30%以上高速化しています。ツールの呼び出しを効率的にまとめて処理する傾向が強まったことで作業ステップ数そのものも削減されています。
安全対策とセーフガード
アライメント監査において、Sonnet 5.5は不正利用への耐性や誠実性の各指標で前世代と同等以上の結果をとなっています。
サイバーセキュリティ能力が向上したことに伴い、Opus 5.5と同様のセーフガードを導入しました。通常の開発業務やバグ修正には影響しませんが、高リスクなサイバーセキュリティ関連タスクについてはSonnet 5へ自動でフォールバックします。生物兵器などのリスクに関するセーフガードはSonnet 5の基準を維持しています。
また、大規模なアカウント作成を通じてモデルの思考プロセスを抽出する「蒸留攻撃」を防ぐための安全分類器をSonnetシリーズとして初めて導入し、思考プロセスの不正抽出を制限する仕組みを取り入れています。
Sonnet 5.5の提供状況
Claude Sonnet 5.5は、APIモデル名「claude-sonnet-5-5」として、Claude Platformのほか、Amazon Web Services(AWS)、Google Cloud、Microsoft Azureで即日利用可能となっています。従来モデルと同様にデータ保持ゼロ(Zero Data Retention)に対応しています。また、Claudeチャット(Claudeアプリ)でもSonnet 5.5が即日でモデル選択可能となっています。
Claude 5.5ファミリーの軽量・大量処理向けモデルとなる「Claude Haiku 5.5」は、数週間以内の登場が予告されています。
出典:
Anthropic 公式サイト(Introducing Claude Sonnet 5.5)
関連記事





