Anthropic、最先端のコーディングモデル「Claude Sonnet 4.5」を発表
Introducing Claude Sonnet 4.5
Anthropicは、世界最高のコーディングモデルであり、複雑なエージェント構築やコンピューター利用に優れた「Claude Sonnet 4.5」を発表しました。推論と数学能力も大幅に向上しています。Claude Codeには、進捗保存とロールバックが可能なチェックポイント機能が追加され、VS Code拡張機能も提供されます。APIには、エージェントの実行時間を延長し複雑性を増すためのコンテキスト編集機能とメモリツールが追加されました。Claudeアプリでは、コード実行とファイル作成が会話に直接統合されました。Claude Agent SDKは、開発者がClaude Codeを構築したのと同じインフラストラクチャを提供します。Claude Sonnet 4.5は、SWE-bench Verified評価で最先端の性能を示し、複雑なマルチステップタスクで30時間以上集中力を維持することが観察されています。OSWorldベンチマークでは、4ヶ月前のSonnet 4の42.2%から61.4%に向上しました。金融、法律、医学、STEMの専門家は、Sonnet 4.5が旧モデルと比較して、ドメイン固有の知識と推論能力が劇的に向上していると評価しています。価格はClaude Sonnet 4と同じで、100万トークンあたり3ドル/15ドルです。また、AI安全レベル3(ASL-3)保護の下でリリースされ、CBRN兵器に関連する潜在的に危険な入出力を検出する分類器が含まれています。
- Anthropicが最高性能のコーディングモデル「Claude Sonnet 4.5」を発表
- OSWorldベンチマークでSonnet 4の42.2%から61.4%に性能向上
- 価格は従来モデルと同じ100万トークンあたり3ドル/15ドルを維持
- AI安全レベル3(ASL-3)保護下でのリリース、CBRN兵器関連入出力検出分類器を搭載
AnthropicがClaude Sonnet 4.5を発表した。最大の注目点は、価格を従来のSonnet 4と完全に同一(入力3ドル/出力15ドル/Mトークン)に維持しながら、OSWorldで42.2%→61.4%と約1.5倍の性能向上を達成した点だ。これは実質的なコストパフォーマンスの大幅改善を意味し、エンタープライズ向けエージェント市場での競争力を強く押し上げる。また、Claude Codeのチェックポイント機能、VS Code拡張、Agent SDKの提供は、開発者エコシステムの囲い込み戦略として評価できる。ASL-3下でのリリースは安全対応コスト増を示唆するが、Anthropicは価格転嫁せずシェア拡大を優先する戦略と見られる。