米国CAISIおよび英国AISIとの連携によるAIセキュリティ対策の強化
Strengthening safeguards with US CAISI and UK AISI
Anthropicは、米国のAI標準・イノベーションセンター(CAISI)および英国AIセキュリティ研究所(AISI)と協力し、AIシステムのセキュリティ強化を進めている。両機関はAnthropicのモデル開発段階にアクセスし、サイバーセキュリティや脅威モデリングの専門知識を活かして、プロンプトインジェクション、暗号化された攻撃、入力・出力の難読化攻撃など、様々な脆弱性を特定した。これらの発見に基づき、Anthropicは「Constitutional Classifiers」と呼ばれる防御システムを改良し、アーキテクチャを再構築するなど、セキュリティ対策を強化した。この協力は、モデルの誤用を防ぎ、実世界での危害を軽減するために不可欠である。Anthropicは、政府機関との緊密な技術協力がAIの安全性と有益性を確保する上で効果的であるという教訓を得ており、他のAI開発者にも同様の連携を推奨している。
- Anthropicが米AI標準・イノベーションセンター(CAISI)および英AIセキュリティ研究所(AISI)と協力し、AIシステムのセキュリティ強化を進めている
- 両政府機関がAnthropicのモデル開発段階にアクセスし、プロンプトインジェクション、暗号化された攻撃、入出力の難読化攻撃などの脆弱性を特定した
- 特定された脆弱性を受け、Anthropicは防御システム「Constitutional Classifiers」を改良し、アーキテクチャを再構築するなどセキュリティ対策を強化した
- Anthropicは政府機関との緊密な技術協力がAIの安全性確保に有効と結論づけ、他のAI開発者にも同様の連携を推奨している
AIの安全性・セキュリティが政府機関との協業で「モデル開発段階から検証される」枠組みが具体化した点が重要。米CAISI・英AISIという規制側の中核機関がAnthropicのモデルにアクセスし、プロンプトインジェクション等の脆弱性を特定したうえで防御機構(Constitutional Classifiers)の再設計に反映されたのは、フロンティアAI企業にとって政府の第三者評価・認定が事実上の参入要件・信頼性の差別化要因になりつつあることを示す。同社が他開発者にも同様の連携を推奨している点は、規制準拠コストと安全性投資の重要性が業界全体に波及するシグナルであり、AI関連投資では安全性・コンプライアンス対応力が中長期の競争力を左右するとみる。