Ling 3.1 Flash は前世代から知能が大きく向上し、特にエージェント能力の改善が顕著で、Artificial Analysis Intelligence Index で 41 を獲得しました
@AntLingAGI が Ling 3.1 Flash をリリースしました。これは合計 560B パラメータ、アクティブ 25B パラメータ、1M トークンのコンテキストウィンドウを持つ推論モデルです。Artificial Analysis Intelligence Index v4.3 で 41 を獲得し、8 月に登場した Ling 3.0 Flash の 20 から向上しました。Ling 3.1 Flash はオープンウェイトになる予定で、Ant Group がまもなくウェイトを公開する見込みです。
主な結果:
➤ Ling 3.1 Flash は前世代からエージェント能力を向上させました。GDPval-AA v2 Elo 1,622、AA-Briefcase Elo 1,400 を記録し、GLM-5.3-Flash、Gemini 3.8 Flash (high)、DeepSeek V4.1 Flash (Max) などの同級モデルに匹敵します。Ling 3.1 Flash は AutomationBench-AA (62%) および Terminal-Bench v4.0 (33%) でも顕著な向上を示しています。
➤ Ling 3.1 Flash は AA-Omniscience で +2 を獲得し、Ling 3.0 Flash (-18) から 22 ポイントの改善です。前世代と比較して、正答率は 18% から 29% に上昇し、同程度の試行率 (56% から 58%) でハルシネーション率は 44% から 38% に低下しており、この向上が主に多くを知っていることに由来し、回答を控えることによるものではないことを示しています。比較として、DeepSeek V4.1 Flash (Max) のハルシネーション率は 97% です。
➤ Ling 3.1 Flash は前世代より大きなモデルで、価格もそれに応じて上がっていますが、トークン効率は向上しています。合計 560B、アクティブ 25B パラメータを持ち、Ling 3.0 Flash の 124B および 5.1B から増加しました。価格は 1M 入力 / 出力トークンあたり $0.30 / $0.90 で、$0.075 / $0.22 から上昇しています。Intelligence Index の実行には 218M 出力トークンを使用し、Ling 3.0 Flash (261M) より 16% 少なくなっています。
➤ Ling 3.1 Flash は一部の同級モデルよりタスクあたりのコストが高いものの、最も魅力的な象限にとどまっています。Ling 3.1 Flash のタスクあたりコストは $0.99 で、GLM-5.3-Flash ($0.42) および DeepSeek V4.1 Flash (Max, $0.32) を大きく上回る一方、$1.24 の Gemini 3.8 Flash (High) よりは低くなっています。
モデルの追加詳細:
➤ サイズ: 合計 560B パラメータ、アクティブ 25B
➤ コンテキストウィンドウ: 1M トークン
➤ 価格: 1M 入力トークンあたり $0.30、1M 出力トークンあたり $0.90、キャッシュ済み入力は 1M あたり $0.06 (80% 割引)
➤ 提供状況: Novita AI を通じて利用可能で、ウェイトはまもなく公開予定

