Anthropic、AIモデル「Claude Opus 4.6」を発表 - 100万トークンコンテキストウィンドウと性能向上
Claude Opus 4.6
Anthropicは、AIモデル「Claude Opus 4.6」を発表しました。この新モデルは、前モデルのコーディング能力を向上させ、より慎重な計画立案、長時間のAIエージェントタスクの維持、大規模コードベースでの信頼性向上、コードレビューおよびデバッグ能力の強化を実現しています。特筆すべきは、Opusクラスのモデルとして初めて、ベータ版ながら100万トークン(1M token)のコンテキストウィンドウを備えたことです。Opus 4.6は、金融分析、リサーチ、ドキュメント・スプレッドシート・プレゼンテーションの作成・利用といった日常業務にも応用可能です。評価では、エージェント型コーディング評価「Terminal-Bench 2.0」で最高スコアを記録し、「Humanity’s Last Exam」では他の最先端モデルをリードしています。経済的に価値のある知識労働タスクを評価する「GDPval-AA」では、OpenAIのGPT-5.2を約144 Eloポイント、前モデルのClaude Opus 4.5を190ポイント上回りました。また、「BrowseComp」では、オンライン上の情報検索能力で他のモデルを凌駕しています。安全性に関しても、業界の他の最先端モデルと同等以上の安全プロファイルを示しています。APIでは、コンテキスト圧縮機能やアダプティブシンキング、エフォートコントロールなどの新機能が導入されています。Claude in Excelの機能も強化され、Claude in PowerPointが研究プレビューとしてリリースされました。Claude Opus 4.6は、claude.ai、API、主要クラウドプラットフォームで利用可能です。価格は100万トークンあたり5ドル/25ドルで据え置かれています。
- AnthropicがAIモデル「Claude Opus 4.6」を発表。Opusクラスで初めて100万トークンコンテキストウィンドウ(ベータ)を搭載。
- Terminal-Bench 2.0で最高スコアを記録。GDPval-AAではOpenAIのGPT-5.2を約144 Eloポイント上回った。
- 価格は100万トークンあたり5ドル/25ドルで据え置き。
- APIにコンテキスト圧縮機能、アダプティブシンキング、エフォートコントロールなどの新機能を導入。
AnthropicがClaude Opus 4.6を発表し、100万トークンのコンテキストウィンドウ(ベータ)をOpusクラスで初めて搭載した点は、大規模コードベースや長時間エージェントタスクといった高付加価値ユースケースでの競争優位性を示している。また、GPT-5.2を約144 Elo上回るGDPval-AAスコアは、経済的価値のある知識労働タスクにおける性能差を定量的に示しており、エンタープライズ向けAI市場でのシェア拡大が期待される。価格が据え置かれていることも収益性向上に寄与する要因で、投資家は同社のエコシステム拡大とAPI利用の普及動向を注視すべきである。