AnthropicのフロンティアAIモデルの進捗報告:サイバーセキュリティとバイオセキュリティのリスク評価
Progress from our Frontier Red Team
Anthropicは、フロンティアAIモデルがサイバーセキュリティとバイオセキュリティ分野で急速に進歩していることを報告しました。サイバーセキュリティ分野では、モデルはCTF(Capture The Flag)演習において、1年で高校生レベルから学部生レベルに向上し、Cybenchベンチマークでは正答率が5%から約3分の1に上昇しました。しかし、専門家レベルにはまだ及ばず、特にリバースエンジニアリングやネットワーク環境での攻撃には課題があります。バイオセキュリティ分野では、モデルはウイルス学の専門家を上回る能力を示しましたが、依然として科学的図表の解釈などでは専門家レベルに達していません。武器化関連タスクの評価では、モデルは初心者に対して一定の支援を提供しましたが、実世界での成功には至らない重大な誤りを含む計画が示されました。Anthropicは、これらの進歩が国家安全保障上のリスクにつながる可能性を認識し、AI Safety Level 3の安全対策への投資を強化する方針です。また、米国AI安全研究所、英国AI安全研究所、および米国エネルギー省(DOE)傘下の国家核安全保障局(NNSA)との連携を通じて、AIの安全性とリスク評価を進めています。
- AnthropicがフロンティアAIモデルのサイバーセキュリティ能力評価結果を公開。CTF演習で1年間に高校生レベルから学部生レベルへ向上、Cybench正答率が5%から約3分の1に上昇
- バイオセキュリティ分野ではモデルがウイルス学専門家を上回る能力を示した一方、科学的図表解釈では専門家レベル未満
- AI Safety Level 3の安全対策への投資強化を発表。米国AI安全研究所、英国AI安全研究所、米国エネルギー省(DOE)/国家核安全保障局(NNSA)との連携を表明
AnthropicがフロンティアAIモデルのサイバー・バイオセキュリティリスク評価結果を公開し、AI Safety Level 3相当の安全対策への投資強化を表明した点が重要。Cybenchなどのベンチマークで急速な能力向上が確認され、国家安全保障リスクの顕在化が近づいている。米国・英国のAI安全研究所やDOE/NNSAとの連携は、今後のAI規制枠組み形成においてAnthropicが主導的立場を取ることを示唆し、同社および関連するAI安全技術ベンダーへの投資機会につながる。