OpenAI、新しいオープンソースモデルファミリー「GPT OSS」を発表
Welcome GPT OSS, the new open-source model family from OpenAI!
OpenAIは、Apache 2.0ライセンスで提供される新しいオープンソースモデルファミリー「GPT OSS」を発表しました。このモデルは、21Bおよび117Bの総パラメータ数(3.6Bおよび5.1Bのアクティブパラメータ)を持ち、4ビット量子化(mxfp4形式)を採用しています。推論、テキスト生成、指示追従、ツール利用をサポートし、transformers、vLLM、llama.cpp、ollamaなどの推論フレームワークと互換性があります。Hugging FaceのInference Providersサービスを通じてAPIアクセスが可能で、ローカルでの推論やファインチューニングもサポートされています。特に、Hopper GPUではmxfp4とFlash Attention 3の併用、AMD Instinct MI300シリーズではMegaBlocks MoEカーネルによる高速化が可能です。モデルの出力は「analysis」と「final」のチャンネルに分かれており、通常は「final」チャンネルの内容のみがユーザーに表示されます。評価時には、推論トレースを除外するために適切な生成サイズと後処理が必要です。
- OpenAIがオープンソースモデルファミリー「GPT OSS」をApache 2.0ライセンスで発表
- Hugging FaceのInference Providersを通じてAPIアクセス提供を開始
OpenAIがクローズドモデル戦略から一転、Apache 2.0ライセンスのオープンソースモデル「GPT OSS」を発表した点は業界構造を大きく変える可能性がある。MoEアーキテクチャと4ビット量子化による推論効率の高さ、主要フレームワークとの互換性により、ローカル/エッジAIの普及が加速する。GPUベンダー依存度の分散(NVIDIA HopperとAMD MI300の両対応)やHugging Faceを通じたAPI提供は、AIインフラの民主化を促進し、エンタープライズ導入の敷居を下げる。ただし「analysis」と「final」の出力チャンネル分割は透明性の観点で監視が必要。