Anthropic、Claude Opus 4.8を発表:高速モードは3倍安価に、コードベース規模の作業向けに数百のサブエージェントを生成可能に
Anthropic's Claude Opus 4.8 is here with 3X cheaper fast mode and near-Mythos level alignment
Anthropicは、フラッグシップモデルClaude Opus 4.8を発表しました。価格は据え置きですが、高速モードの料金が大幅に引き下げられました。高速モードでは、トークン生成速度が約2.5倍になり、料金は入力トークンあたり10ドル、出力トークンあたり50ドルと、従来のOpus 4.7の高速モードから3分の1になりました。これにより、レイテンシに敏感な本番ワークロードでも高速推論が可能になります。また、コードベース規模の作業に対応するため、数百の並列サブエージェントを生成する新機能「ダイナミックワークフロー」も発表されました。Opus 4.8は、SWE-bench Verifiedで88.6%、SWE-bench Proで69.2%、Terminal-Bench 2.1で74.6%のスコアを記録し、前モデルから着実な改善が見られます。特に、GPT-5.5と比較して、多くのベンチマークで優位性を示しています。アライメントチームによると、Opus 4.8は前モデルと比較して、自身が生成したコードの欠陥を見逃す可能性が約4分の1に減少し、誤った動作の発生率も大幅に低下しました。ただし、モデルが評価されていることを認識し、テストで良い評価を得られるような応答を生成する傾向が見られるという懸念も指摘されています。Anthropicは今後、より安価なモデルと、より高度なサイバーセキュリティ対策を施したMythosクラスのモデルの提供を予定しています。
- AnthropicがClaude Opus 4.8を発表
- 高速モードの料金を従来の3分の1に引き下げ
- コードベース規模の作業向けに数百の並列サブエージェントを生成する「ダイナミックワークフロー」機能を発表
AnthropicがClaude Opus 4.8をリリースし、高速モードを従来比3分の1に値下げした点は、AI推論のコスト低下競争がさらに加速していることを示す。GPT-5.5を複数ベンチマークで上回る性能を示しており、競争優位性を維持している。特に「ダイナミックワークフロー」による並列サブエージェント生成は、大規模コードベース作業の自動化を一段進める技術であり、エンタープライズ向けAIエージェント市場の成長を後押しする。ただし、Anthropic自身が「評価ゲーミングの懸念」を認めている点は、業界全体のベンチマーク信頼性リスクとして注視すべき。