Artificial Analysis · X

ミストラルはミストラル・ラージャル4を発表し、人工分析インテリジェンス指数で38点を記録した。フランスが再び最も高い位に戻った…

MistralはMistral Large 4を公開し、人工分析インテリジェンス指数で38点を記録した。フランスは再び米国や中国以外で最も優れたモデルを持つ国となった。@MistralAIはMistral Large 4を研究向けのパブリックプレビューとして公開し、10月末には1Tパラメータモデル(49Bアクティブ)のウェイトを公開する計画である。このモデルは人工分析インテリジェンス指数で38点を達成し、GPT-6…

画像の出典 · Artificial Analysis · X

ミストラルはミストラル・ラージュ4を公開し、人工分析インテリジェンス指数で38点を記録した。フランスは再び米国や中国以外で最もインテリジェントなモデルを持つ国となった。

@MistralAIは、Mistral Large 4の研究公開プレビューを公開しました。1Tパラメータモデル(49Bアクティブ)の重みを10月末に公開する予定です。このモデルは人工分析インテリジェンス指数で38点を記録し、GPT-6 Luna(最大値38)やDeepSeek V4.1 Flash(最大値39)と同等です。また、人工分析サイバー指数では50%のスコアを達成し、GLM-5.3-Flashと同等であり、Kimi K3やDeepSeek V4.1 Flash(最大値)といったモデルよりも優れています。

Mistral Large 4プレビューの重要なベンチマーク結果:

➤ 米国と中国以外で最も賢いモデル:Mistral Large 4 Previewはインテリジェンス指数で38点を獲得し、DeepSeek V4.1 Flash(最大39点)やGPT-6 Luna(最大38点)と同等です。これにより、米国と中国以外で最も賢いモデルとなり、韓国やアラブ首長国連邦のような国々を上回ります

➤ Cyber防衛能力に関するGLM-5.3-Flashとのレベル:Mistral Large 4 Previewは人工分析Cyber Indexで50点を獲得し、GLM-5.3-Flashと同水準(50点)となり、MiMo-V2.6-Pro(56点)よりも低い。重量が公開されると、Cyber Index上でトップ3のオープン重量モデルに入ることになる。最も高い成績はCyberGym-E2E-AAで、82%を獲得し、MiMo-V2.6-Pro(79%)やGPT-6 Luna(最大78%)よりも高い。

類似の知能を持つオープンウェイトモデルの場合、タスクあたりのコストが4倍を超える:Mistral Large 4 Previewは、標準価格である1M入力/出力テキストあたり1.36ドル/4.18ドル、キャッシュされた1M入力テキストあたり0.14ドルで、知能インデックスタスクあたり1.13ドルをかけて運用される。最初の2週間は、Mistral Large 4 Previewは50%の割引で提供され、タスクあたりのコストが0.57ドルに下がる。これでも依然としてGLM-5.3-Flash(0.25ドル)やDeepSeek V4.1 Flash(最大0.27ドル)よりも高価である。

➤強力な文書および画像推理:Mistral Large 4のプレビューではGDP.pdfで19%のスコアを記録し、MiMo-V2.6-Proと同等(19%)であり、Kimi K3は22%であった。これはMistral Large 3から18ポイントの改善であり、一部はAPIの改善によるもので、今では1回のリクエストで100枚の画像を受け付けるようになり、以前のMistralモデルでは8枚だった。

主要モデルの詳細:

➤コンテキストウィンドウ:512kトークン

➤ 多様性:テキストと画像の入力、およびテキストの出力

➤ 料金:1Mの入力/出力トークンあたり$1.36/$4.18、1Mのキャッシュされた入力トークンあたり$0.14。最初の2週間は50%割引で$0.68/$2.09。

➤利用可能性:MistralのAPIにおける研究公開プレビューがあり、10月末にはオープンウエイトが提供される予定です

原文の出典

Artificial Analysis · X

内容について

原文の公開と権利は出典元に帰属します。

機械翻訳 · 原文をご参照ください