Anthropicは2026年9月22日、Claude 5.5ファミリー最初のモデルとなるClaude Opus 5.5を公開しました。同社は多くの作業でClaude Fable 5.1と同等の性能を示し、Opus 5より実行コストが40%低いと説明しています。
ClaudeはAnthropicが開発する大規模言語モデルのファミリーで、推論やエージェント作業を想定したモデルをClaude API経由でアプリケーションに組み込めます。
価格と速度
Anthropicは、Opus 5.5がOpus 5より少ない計算量で提供できるとし、価格に反映したと述べています。エージェント用途やコーディング作業のコストの大半を占めるキャッシュ読み取りの引き下げ幅が最も大きく、60%減となっています。
| 項目 | Opus 5.5 | Opus 5比 |
|---|---|---|
| 入力トークン | 100万あたり4ドル | 20%減 |
| 出力トークン | 100万あたり20ドル | 20%減 |
| キャッシュ読み取り | 100万あたり0.20ドル | 60%減 |
| 典型的ワークロードのコスト(デフォルト設定) | — | 40%減 |
| 出力速度 | — | 30%以上向上 |
価格引き下げに加えて、AnthropicはPro、Max、Team、シートベースのEnterpriseプランで5時間の利用量制限を拡大しました。サブスクリプション利用者にはレート制限のリセットを提供し、保存して任意のタイミングで使用できるとしています。
性能に関する検証事例
Anthropicは早期テスターの事例として、680,000行のコード移行が1日未満で完了したと述べています。同社はこれをエンジニアリングチームなら数週間かかる作業だとしています。また同社がウェブアプリの全ページのロード時間短縮を指示した試験では、Opus 5.5が40回中39回成功し、Opus 5は改善幅が小さくアプリの挙動も変えたとしています。別のテスターが単一のプロンプトから複数のClaudeモデルにゲームを作らせた試験では、グラフィックスと仕上げの完成度でOpus 5.5が他のどのモデルより高いスコアだったとしています。
コミュニケーション面では、早期テスターが文章がより明確で追いやすいと評価し、重要な情報を先頭に置く点、長時間のセッションでの作業のしやすさが挙げられています。
安全性と外部評価
公開前の評価は、Frontier DesignとMETRを含む外部評価者が実施しました。METRはAIモデルの能力とリスクを評価する研究組織で、長い作業の完遂能力やソフトウェア開発の生産性を検証しています。
数千のシミュレーションシナリオでClaudeを試験する自動行動監査では、Opus 5.5がこれまで同社が試験した中で最も高い成績を示したとしています。不可逆性の高い行動や与えられた範囲外の行動を取りにくく、Opus 5よりプロンプトインジェクションに強いと説明しています。Anthropicはアラインメント試験の対象を、より長いタスク、達成不可能なタスク、実際のインシデントを模したシナリオへ広げたとしつつ、依然として限界があるとしています。評価の詳細はOpus 5.5のシステムカードに掲載されています。
利用条件
Opus 5.5は生物学とサイバーセキュリティでClaude Mythos 5.1に匹敵するため、AnthropicはClaude Fable 5.1と同様のセーフガードを付けて展開します。
- 審査済み組織は、Life Sciences Verification Programに申請することで、Opus 5.5を生物学研究に利用できます。
- Anthropicは今後数週間でCyber Verification Programへのアクセスを拡大し、認証済みのサイバーセキュリティ実務者がOpus 5.5を業務に利用できるようにする予定です。
Claude Sonnet 5.5とClaude Haiku 5.5は今後数週間で続き、性能、効率、安全性に関する同様の改善が入る予定です。

まだコメントはありません。