Apple、オンデバイスAIのメモリ制限を克服する新アーキテクチャを発表
On-device AI agents hit a hard memory limit. Apple's new architecture routes around it.
AppleはWWDC26で、オンデバイスAIモデルのメモリ制限を克服する第3世代基盤モデル「AFM 3」ファミリーを発表した。従来のオンデバイスAIはDRAMの容量に制約があったが、AFM 3はモデルの重みセットをDRAM外のNANDフラッシュに保存することで、200億パラメータのモデル(AFM 3 Core Advanced)をオンデバイスで動作させることを可能にした。これは、プロンプトごとに必要なエキスパート(モデルの一部)をNANDからDRAMにロードする方式を採用し、トークンごとの重み移動を不要にすることで実現された。これにより、オンデバイスAIの能力が大幅に向上し、企業はクラウド依存か限定的なオンデバイスモデルかの選択を迫られる状況が変わる。サーバーサイドモデルはGoogle Cloud上のNvidia GPUで動作し、プライベートクラウドコンピューティングの境界内でプライバシーを保証する。Appleは、詳細なベンチマークを含む技術レポートを夏に公開予定である。
- AppleがWWDC26で第3世代基盤モデル「AFM 3」ファミリーを発表
- AFM 3 Core Advancedは200億パラメータモデルで、重みセットをNANDフラッシュに保存しプロンプトごとにエキスパートをDRAMにロードする方式でオンデバイス動作を実現
- サーバーサイドモデルはGoogle Cloud上のNvidia GPUで動作
AppleがオンデバイスAIの最大の制約であるメモリ容量問題を、NANDフラッシュを活用したアーキテクチャで解決した点は注目に値する。200億パラメータモデルのオンデバイス動作が現実化すれば、クラウド依存度が低下し、プライバシー・レイテンシ・コスト面で競合に対し優位に立つ可能性がある。ただし、サーバーサイドは依然Google Cloud上のNvidia GPUに依存しており、AIインフラ全体としてのAppleの垂直統合戦略にはまだ課題が残る。詳細なベンチマークが夏に公開される予定であり、実際の性能と電力効率の検証が次の焦点となる。