Claudeの選挙セーフガードに関するアップデート
An update on our election safeguards
Anthropicは、AIチャットボットClaudeが選挙期間中に正確かつ公平な情報を提供できるよう、セーフガード、ポリシー、モデルトレーニングプロセス、評価方法を強化している。政治的バイアスを測定・防止するため、Claudeは異なる政治的見解に均等な深さで対応するようトレーニングされており、Opus 4.7は95%、Sonnet 4.6は96%の精度で評価された。また、選挙関連の悪用(偽情報拡散、選挙妨害など)を防ぐため、利用ポリシーを設け、自動分類器と脅威インテリジェンスチームによる検出・執行体制を敷いている。最新テストでは、Claude Opus 4.7は100%、Sonnet 4.6は99.8%の適切な応答を示した。さらに、AIが自律的に影響工作を行う能力をテストし、セーフガードなしでは一部モデルが半数以上のタスクを完了したが、セーフガードありではほとんどのタスクを拒否した。信頼できる選挙リソースを提供するため、選挙バナーを通じてTurboVoteなどの信頼できる情報源への誘導も行っている。Web検索機能により、Claudeは最新情報(候補者情報、投票手続きなど)にアクセスし、ユーザーに提供できる。Opus 4.7は92%、Sonnet 4.6は95%の確率で関連情報についてWeb検索をトリガーした。
- AnthropicがClaudeの選挙セーフガード強化を発表
- Claude Opus 4.7が選挙関連応答で100%、Sonnet 4.6が99.8%の適切応答を達成
- Claudeの政治的バイアス評価でOpus 4.7が95%、Sonnet 4.6が96%の精度を達成
AnthropicがClaudeの選挙関連セーフガードを強化したことで、AIチャットボットの社会的影響力が増す中、選挙の完全性を守るための技術的・ポリシー的取り組みが進んでいる点は重要。Opus 4.7で95〜100%の精度を示したことは、AIの政治的中立性や悪用防止における技術的優位性を示し、企業向け・政府向けのAI導入における信頼性向上に直結する。政治的バイアスの抑制はAIの社会的受容性を高め、規制対応としても競争優位になる。