Nemotron 3.5 Content Safety: カスタマイズ可能なマルチモーダル安全機能でグローバルAIを保護
Nemotron 3.5 Content Safety: Customizable Multimodal Safety for Global Enterprise AI
Nemotron 3.5は、テキストと画像を統合的に理解し、単一のコンテキストウィンドウで安全性評価を行うマルチモーダルAIモデルです。これにより、テキストと画像の相互作用や、リクエストとレスポンス間のポリシー違反を一度の処理で検出できます。12言語での明示的なトレーニングに加え、Gemma 3ベースモデルから約140言語へのゼロショット汎化能力も備えています。Nemotron 3.5の最大の特徴は、カスタムポリシー仕様をモデルに直接入力できるようになった点です。これにより、ヘルスケア、金融サービス、教育アプリなど、異なるリスクプロファイルを持つ多様なプロダクション環境に合わせて、安全ポリシーを柔軟に適用できます。また、「THINKモード」を有効にすると、モデルは最終的な安全/危険判定に至るまでのステップバイステップの推論過程を出力し、監査可能なトレーサビリティを提供します。このモデルは、NVIDIA Gemma 3 4B ITをベースに、LoRAアダプターでファインチューニングされており、8GB以上のVRAMを持つGPUでリアルタイム展開が可能なコンパクトさを維持しています。Nemotron 3.5のトレーニングに使用されたマルチモーダル、多言語対応の安全データセットも公開されており、これには実際の写真や、カスタムポリシー適用と推論能力を強化するためのデータが含まれています。評価では、マルチモーダルおよび多言語の安全ベンチマークにおいて約85%の有害コンテンツ分類精度を示し、Nemotron 3と比較して同等の低遅延性を維持しています。Nemotron 3.5はHugging Faceで公開されており、研究および商用利用が可能です。
- NVIDIAがマルチモーダルAI安全性モデルNemotron 3.5 Content Safetyを公開
NVIDIAがNemotron 3.5 Content Safetyをリリースしたことは、AI安全性分野における同社のプレゼンス強化を示す。カスタムポリシー適用による業種別(ヘルスケア、金融など)の安全評価対応は、AIのプロダクション導入が進む中で需要が高まる領域であり、NVIDIAのAIプラットフォーム戦略を補完する。Hugging Faceでの公開によりコミュニティでの普及が進めば、GPU需要の間接的な喚起にもつながる可能性がある。