A.I.AI
JetBrainsが低レイテンシーなテキスト・コード処理に最適化された12BパラメータのMixture-of-Expertsモデル「Mellum2」を公開
Introducing Mellum2: A 12B Mixture-of-Experts Model by JetBrains
HFHugging Face
AIが原文を翻訳・要約しています
JetBrainsは、自然言語とコードで学習された12BパラメータのMixture-of-Experts(MoE)モデル「Mellum2」を公開しました。このモデルはトークンごとに2.5Bパラメータのみをアクティブにするため、高スループット・低レイテンシーな推論が可能で、ルーティング、RAG、要約、サブエージェント、コーディング機能、プライベートデプロイメントなどに利用できます。Apache 2.0ライセンスで提供され、同サイズのモデルと比較してベンチマーク性能で競争力がありながら、推論速度は2倍以上高速です。Mellum2は、AIシステムにおけるルーティング、検索、要約などのレイテンシーに敏感なタスクに焦点を当てており、ソフトウェアエンジニアリング向けのAIシステム構築に適しています。
KEY POINTS要点記事から抽出した重要情報
- JetBrainsが低レイテンシーなテキスト・コード処理に最適化された12BパラメータのMoEモデル「Mellum2」をApache 2.0ライセンスで公開
CONTEXT文脈編集部による背景整理
JetBrainsが公開したMellum2は、12BパラメータのMoEモデルでありながらトークンあたり2.5Bパラメータのみをアクティブにする設計で、推論速度が同サイズモデル比で2倍以上高速という点が特筆すべきポイント。ルーティング、RAG、要約、サブエージェントといったレイテンシー敏感なタスクに特化しているため、開発ツール大手JetBrainsが自社エコシステム向けにこのモデルをどう活用するかが注目される。Apache 2.0ライセンスで公開されていることから、企業のプライベートデプロイ需要を取り込む戦略と見られ、ソフトウェアエンジニアリングAI市場における競争力強化につながる可能性がある。
原文を読むAnalyzed at 2026年6月2日 23:02