CerebrasとOpenAIがGPT-5.6 Solの「Ultrafastモード」を発表、推論速度を大幅に向上
Accelerating GPT-5.6 Sol Ultrafast
CerebrasとOpenAIは、OpenAI APIで提供開始される新サービス「Ultrafastモード」を発表した。このモードはCerebrasの技術を基盤とし、GPT-5.6 Solモデルにおいて、品質を損なうことなく毎秒750トークンまで出力可能にする。これにより、特に時間的制約の厳しいミッションクリティカルな業務の高速化を目指す。GPT-5.6 Sol Ultrafastモードは、従来のモデルと比較して、例えば「Humanity's Last Exam」ベンチマークにおいて、Claude Fable 5よりも約7倍速く、全2,500問を11時間11分で解答した。また、経済的に価値のあるタスクを評価するGDP-Valベンチマークでは、5.6倍の速度向上を実現した。この高速化は、CerebrasのWafer-Scale Engineアーキテクチャにより、GPUにおけるメモリ帯域幅のボトルネックを解消し、モデルの重みをチップ上に保持することで実現されている。Ultrafastモードは現在一部顧客向けに限定プレビューで提供されており、今後アクセスが拡大される予定。
- OpenAIとCerebrasがGPT-5.6 SolのUltrafastモードを発表。毎秒750トークンの出力を品質を損なわずに実現
- Humanity's Last ExamベンチマークでClaude Fable 5より約7倍速く、全2,500問を11時間11分で解答
- GDP-Valベンチマークで5.6倍の速度向上を実現
- CerebrasのWafer-Scale EngineアーキテクチャによりGPUのメモリ帯域幅ボトルネックを解消し、モデル重みをチップ上に保持
- Ultrafastモードは現在一部顧客向けに限定プレビューで提供開始
OpenAIとCerebrasの提携によるUltrafastモードは、推論速度という実用面での差別化をAIモデル競争に持ち込むものであり、エンタープライズ向けミッションクリティカルなワークロードでの採用拡大に寄与する可能性がある。CerebrasのWafer-Scale EngineがGPUのメモリ帯域幅ボトルネックを解消する独自ポジションを獲得している点は、半導体・AIインフラ投資の観点でも注目に値する。現状は限定プレビューであり、商用化の規模拡大が今後の収益インパクトの鍵となる。