Claude 3.7 Sonnetの新機能:拡張思考モードと可視化された思考プロセス
Claude's extended thinking
Anthropicは、AIモデルClaude 3.7 Sonnetに「拡張思考モード」を導入しました。これにより、ユーザーはより複雑な問題に対してモデルがより深く思考するように指示でき、開発者は「思考予算」を設定して思考時間を制御できます。このモードはモデルを変更するのではなく、同じモデルにより多くの時間と労力を費やすことを可能にします。また、Claudeの思考プロセスを可視化する機能も追加され、信頼性向上、アライメント研究、そしてユーザーの興味を引くことが期待されます。しかし、思考プロセスの可視化は、デフォルト出力よりもパーソナルでない印象を与えたり、モデルの思考が必ずしも正確ではないため、誤解を招く可能性もあります。さらに、悪意のあるユーザーによるジェイルブレイク戦略の構築や、モデルが意図的に思考を隠すインセンティブを生む可能性といった安全保障上の懸念も指摘されています。Claude 3.7 Sonnetは、関数呼び出しを反復的に実行し、環境変化に応答してオープンエンドなタスクを完了する「アクションスケーリング」能力も向上しており、OSWorldのような評価で性能が向上しています。さらに、ゲーム「Pokémon Red」をプレイする能力も向上し、3人のジムリーダーを倒すことができました。技術的には、「シリアルテスト時間計算」と「パラレルテスト時間計算」というアプローチにより、モデルの性能向上が図られています。特に、パラレルテスト時間計算はGPQA評価で顕著な改善を示しました。安全性に関しては、Claude 3.7 SonnetはAI Safety Level (ASL) 2の基準を満たしていますが、CBRN兵器関連タスクでの性能向上も見られ、ASL-3への移行も視野に入れています。可視化された思考プロセスには、 child safety, cyber attacks, dangerous weaponsなどの潜在的に有害なコンテンツが含まれる場合、暗号化される措置が取られます。また、コンピュータ使用能力におけるプロンプトインジェクション攻撃への耐性も向上しています。
- AnthropicがClaude 3.7 Sonnetに拡張思考モードを導入し、思考予算の設定による思考時間制御を可能にした
- Claude 3.7 SonnetはOSWorld評価で性能向上を示し、アクションスケーリング能力が改善された
- Claude 3.7 SonnetはAI Safety Level (ASL) 2の基準を満たしているが、CBRN兵器関連タスクでの性能向上によりASL-3への移行も視野に入れている
AnthropicがClaude 3.7 Sonnetに「拡張思考モード」を導入した点は、AIモデルの性能向上がパラメータ増加ではなく「テスト時計算量(テスト時間計算)」の増加で達成される新たなパラダイムを示している。これはOpenAIのo1系モデルと同様の方向性であり、AI業界全体で「推論時の計算リソース配分」が競争軸になりつつあることを示唆する。投資家としては、推論コストと性能のトレードオフを制御する技術(思考予算)を持つ企業の競争優位性、およびASL-2からASL-3への移行がもたらす規制リスクと安全対策費用の増加に注目すべきである。