Anthropic、Claude Opus 4.8を発表:性能向上と新機能を追加
Introducing Claude Opus 4.8
Anthropicは、AIモデル「Claude Opus」の最新バージョンである「Claude Opus 4.8」を発表しました。Opus 4.8は、Opus 4.7と比較して、様々なベンチマークで性能が向上し、より効果的な協調作業が可能になっています。価格は据え置きです。新機能として、claude.aiユーザーはClaudeがタスクに費やす努力量を制御できるようになり、Claude Codeには「ダイナミックワークフロー」機能が追加され、大規模な問題に対応できるようになりました。また、Opus 4.8の高速モードは、以前のモデルよりも3倍安価になりました。Opus 4.8は、コーディング、エージェントスキル、推論、実務知識タスクにおいて、先行モデルやGPT-5.5を上回る性能を示しています。特に、エージェントタスクにおいては、判断力、信頼性、正確性が向上し、多くのテストケースをエンドツーエンドで完了しました。また、法務分野のベンチマークでは、これまでに記録された最高スコアを達成し、弁護士業務の委任に自信を持てるレベルの精度向上を実現しています。さらに、Opus 4.8は、以前のバージョンよりも正直さが増し、不確かな点や証拠が薄い主張を回避する傾向が約4倍強くなっています。アライメント評価では、ユーザーの自律性を支援し、ユーザーの最善の利益のために行動するなどの親社会的な特性において新たな高みに達し、誤った行動の発生率が大幅に低下しました。その他、Claude Codeでの「ダイナミックワークフロー」機能、claude.aiとCoworkでの「努力量制御」、Messages APIでのシステムエントリのサポートも同時に開始されました。Anthropicは今後、Opusと同等の能力をより低コストで提供するモデルや、Opusを超える知能を持つ新クラスのモデル(Claude Mythos Preview)の開発を進めています。Claude Opus 4.8は本日より利用可能で、通常の利用料金はOpus 4.7と同額ですが、高速モードの料金は変更されています。
- AnthropicがAIモデル「Claude Opus 4.8」を発表・提供開始
- Opus 4.8が法務分野のベンチマークで過去最高スコアを達成
- Opus 4.8がコーディング・エージェントスキル・推論でGPT-5.5を上回る性能を示した
- Opus 4.8の高速モード価格を従来比3倍安く設定
- Claude Codeに「ダイナミックワークフロー」機能を追加
AnthropicがClaude Opus 4.8をリリースし、エージェントタスクや法務分野でGPT-5.5を上回る性能を示した点は注目に値する。特に、法務分野での弁護士業務委任レベルの精度向上は、AIの業務適用範囲を大きく広げる可能性があり、LegalTech市場での競争優位につながる。また、Opus 4.8の高速モードが3倍安価になった点は、エンタープライズ導入のハードルを下げ、利用拡大と収益増加に寄与する。さらに次世代モデル「Claude Mythos Preview」の開発言及は中長期的な成長ストーリーを強化しており、OpenAI/Googleとの競争激化の中でAnthropicの技術的リーダーシップが持続するかを注視すべき。