IT之家 10月9日の報道によると、JetBrainsは昨日(10月8日)にブログを公開し、Mellum2.1モデルをリリースしたと発表しました。このモデルは、インテリジェントプログラミング能力を強化することを重点としています。このモデルは、Mellum2の12B混合エキスパートアーキテクチャを継続し、2.5Bのアクティブパラメータを持ち、Apache 2.0ライセンスで配布されます。
Mellum2.1は、主に予訓練後の強化学習段階をアップグレードし、短期の終了段階から訓練の主体へと拡大した。また、数学、アルゴリズム競技、科学、ツールの使用、ソフトウェアエンジニアリングなどのタスクにおいて、訓練データを追加する。
JetBrainsはこのモデルに内部強化学習環境の基盤を構築し、訓練期間中に数百万個のサンドボックスを起動し、数千種類の環境をカバーする。さらに、訓練前にはチームが開放されたデータセットを選定し、テスト上の欠陥、検証不可能な答え、難易度が不適切なタスクを排除した。
アップグレード後、Mellum2.1はコードライブラリを探索し、ファイルを編集し、自身の変更内容を確認できる。JetBrainsによると、最大の改善点はアイドルプログラミング分野においてで、モデルは失敗テストの根本的な原因を認識し、修正案を作成し、その結果を検証することができる。
性能に関しては、Mellum2.1とMellum2アーキテクチャは同じであり、速度は変わらないが、多ターム予測(MTP)によって応答速度がさらに向上する。単一リクエストのシナリオでは、MTPにより速度が約1.6倍に向上する。


JetBrainsは、Mellum2.1とMellum2、Qwen3.5-9B、およびGemma 4 E4Bを同じ評価設定の下で比較しました。その結果、高負荷時にMellum2.1の推論スループットにおけるトークン数は、Qwen3.5-9Bの約2倍に近いということになり、プログラミング、アルゴリズムコンテスト、数学、ツール呼び出し、そして一般知識などの分野で向上が見られました。IT之家では関連するスクリーンショットを以下の通り掲載しています:

Mellum2.1はすでにHugging Faceにログインでき、ローカルまたは自社のインフラ環境での配備をサポートしています。これにより、企業はコードとデータを自身の環境内に保持することが可能です。公式には、llama.cpp、Ollama、LM Studio向けのGGUFバージョンや、vLLMのMTP推測デコーディング成分も提供される予定です。
