Anthropic、新AIモデル「Claude Opus 5」を発表、性能向上とコスト削減を実現
Introducing Claude Opus 5
Anthropicは、新しいAIモデル「Claude Opus 5」を本日より提供開始した。Opus 5は、前モデルのOpus 4.8と同価格でありながら、性能を大幅に向上させ、特にソフトウェアエンジニアリング、知識作業、科学研究などの分野で最先端の性能を発揮する。Frontier-Bench v0.1ではOpus 4.8の2倍以上の性能をより低コストで実現し、CursorBench 3.2ではFable 5のピークスコアに迫る性能を半額で達成した。また、ARC-AGI 3では他のモデルの3倍、Zapier AutomationBenchでは1.5倍のタスク完了率を示し、OSWorld 2.0ではFable 5の最高結果を3分の1のコストで上回った。生命科学分野でも、特に有機化学やタンパク質関連タスクでOpus 4.8を上回る性能を示している。Opus 5は、自己検証能力と反復処理能力が向上しており、複雑なタスクやデバッグ、コード生成において顕著な能力を発揮する。安全性とアライメントにおいても、Opus 4.8、Sonnet 5、Fable 5よりも優れた性能を示し、最もアライメントされたモデルとなっている。ただし、サイバーセキュリティや生物学研究の最先端領域ではMythos 5に後れを取る部分もある。Opus 5は、APIでは入力トークンあたり5ドル、出力トークンあたり25ドルで提供され、高速モードも利用可能である。また、APIでの自動フォールバック機能や、Claude Platformでの会話中のツール変更機能もベータ版としてリリースされる。
- Anthropicが新しいAIモデル「Claude Opus 5」を発表し、提供開始した
- Opus 5は前モデルOpus 4.8と同価格でありながら、Frontier-Bench v0.1で2倍以上の性能を低コストで達成した
- CursorBench 3.2では競合Fable 5のピークスコアに迫る性能を半額で実現した
- API価格は入力トークンあたり5ドル、出力トークンあたり25ドルで提供される
AnthropicがClaude Opus 5を発表。前モデルと同価格帯でありながら性能が大幅に向上し、複数のベンチマークで競合他社の最高性能を低コストで上回っている点が重要。特にソフトウェアエンジニアリングや科学研究での性能向上は、AIエージェント市場の拡大を示唆しており、API価格設定(入力5ドル/出力25ドル)が競争力を持つかどうかが今後の市場シェア争いの焦点となる。また、自己検証能力と反復処理能力の向上は、AIエージェントの実用性を高める要素であり、AI活用のユースケース拡大に寄与する可能性がある。