Alibaba、GPT-5.6 Sol MaxやFable 5を凌駕する「Qwen3.8-Max」を発表、自律型コンピューティング分野での優位性を主張
Qwen3.8-Max arrives with a bold claim: it outperforms GPT-5.6 Sol Max and Fable 5 on agentic computer use
Alibabaは、2.4兆パラメータを持つ大規模混合エキスパート(MoE)マルチモーダルLLM「Qwen3.8-Max」を発表しました。このモデルは、自律型ソフトウェアエンジニアリングや長期間にわたるエンタープライズワークに焦点を当てています。公開されたベンチマークによると、Qwen3.8-MaxはOSWorld-Verifiedベンチマークで86.1を記録し、GPT-5.6 Sol Max(83.2)やFable 5(85.0)を上回りました。また、PaperBenchでも最高スコアを達成し、ソフトウェアエンジニアリング、研究再現、マルチモーダル推論、ビジュアルWeb開発などの分野でも競争力のある性能を示しています。Alibabaは来週、Qwen3.8-Maxのオープンウェイト版をリリースする予定ですが、ライセンス条件は未定です。Qwen3.8-Maxは、特に長期間のソフトウェアエンジニアリング、コンピューター利用エージェント、研究自動化、マルチモーダル産業ワークフローにおいて、エンタープライズでの活用が期待されています。API価格も、Claude Opus 5やGPT-5.6 Sol Maxと比較して大幅に低く設定されています。
- Alibabaが2.4兆パラメータのMoEマルチモーダルLLM「Qwen3.8-Max」を発表
- OSWorld-Verifiedベンチマークで86.1を記録し、GPT-5.6 Sol Max(83.2)やFable 5(85.0)を上回った
- 来週オープンウェイト版をリリース予定(ライセンス条件は未定)
- API価格がClaude Opus 5やGPT-5.6 Sol Maxと比較して大幅に低く設定
AlibabaがGPT-5.6 Sol MaxやFable 5を上回る性能の大規模MoEマルチモーダルLLM「Qwen3.8-Max」を発表したことは、中国系大手テックによる生成AI分野での競争力強化を示す重要なシグナルです。特にオープンウェイト版のリリース予定と大幅に低いAPI価格設定は、エンタープライズ向けAI市場での価格破壊とシェア獲得戦略を示唆しており、OpenAIやAnthropicなどの競合モデルの価格体系や市場ポジションに影響を与える可能性があります。