A.I.AI
NVIDIA Nemotron 3.5 Lightning: ハイブリッドアーキテクチャと1Mトークンコンテキストを備えたLLM
Nvidia Nemotron 3.5 Lightning
YHacker News
AIが原文を翻訳・要約しています
NVIDIAは、総パラメータ数30B(アクティブ3B)のLLM「Nemotron 3.5 Lightning」を発表しました。このモデルは、Mamba-2、MoE、Attentionを組み合わせたハイブリッドアーキテクチャを採用し、最大1Mトークンのコンテキスト長をサポートします。シングルGPUでのデプロイが可能で、NVIDIA Blackwell、Hopper、Ampereなどのハードウェアに対応しています。英語、スペイン語、フランス語、ドイツ語、イタリア語、日本語などの言語をサポートし、商用利用も可能です。リリース日は2026年8月11日です。モデルは、長時間の自律エージェント、サブエージェントのワークロード、個人ハードウェアでの効率的なローカル推論に最適化されています。ライセンスはOpenMDW License Agreement v1.1です。
KEY POINTS要点記事から抽出した重要情報
- NVIDIAが総パラメータ数30B(アクティブ3B)のLLM「Nemotron 3.5 Lightning」を発表した。
- Mamba-2、MoE、Attentionを組み合わせたハイブリッドアーキテクチャを採用し、最大1Mトークンのコンテキスト長をサポートする。
- シングルGPUでのデプロイが可能で、NVIDIA Blackwell、Hopper、Ampereなどのハードウェアに対応している。
- 商用利用可能で、OpenMDW License Agreement v1.1でライセンス提供される。
CONTEXT文脈編集部による背景整理
NVIDIAがハイブリッドアーキテクチャ(Mamba-2、MoE、Attention)を採用したLLMを公開した点は、AIモデル開発の効率化トレンドを示しており、シングルGPUでのデプロイが可能な点はエッジ/ローカル推論市場の拡大を示唆する。NVIDIAのAIエコシステム戦略の一環として、同社のハードウェア販売を促進する可能性があり、投資家はモデル公開が同社のGPU需要を下支えする点に注目すべき。
原文を読むAnalyzed at 2026年8月12日 00:01