Mistral hat den Mistral Large 4 veröffentlicht, der im Artificial Analysis Intelligence Index 38 Punkte erreicht hat; Frankreich ist wieder das intelligenteste Modell außerhalb der USA und Chinas.
@MistralAI hat Mistral Large 4 in der Forschungsöffentlichkeit vorgestellt, und es ist geplant, die Gewichte des 1T-Parameter-Modells (49B aktiv) Ende Oktober veröffentlichen zu lassen. Es erreicht 38 Punkte im Artificial Analysis Intelligence Index, was GPT-6 Luna (max. 38) und DeepSeek V4.1 Flash (max. 39) entspricht. Zudem erreicht es 50% im Artificial Analysis Cyber Index, auf dem Niveau von GLM-5.3-Flash und vor Modellen wie Kimi K3 und DeepSeek V4.1 Flash (max.).
Schlüsselbenchmarkergebnisse für den Mistral Large 4 Preview:
➤ Das intelligenteste Modell außerhalb der USA und Chinas: Mistral Large 4 Preview erreicht 38 Punkte im Intelligenzindex, was mit DeepSeek V4.1 Flash (max. 39) und GPT-6 Luna (max. 38) vergleichbar ist. Damit ist es das intelligenteste Modell außerhalb der USA und Chinas, vor Ländern wie Südkorea und den Vereinigten Arabischen Emiraten.
➤ Level mit GLM-5.3-Flash in der Cyberverteidigungskapazität: Mistral Large 4 Preview erreicht 50 Punkte im Artificial Analysis Cyber Index, gleichauf mit GLM-5.3-Flash (50) und hinter MiMo-V2.6-Pro (56). Sobald die Gewichte veröffentlicht werden, wird es unter den drei Top-Modellen der offenen Gewicht-Modelle im Cyber Index rangieren. Sein stärkster Erfolg ist bei CyberGym-E2E-AA, wo es 82% erreicht, vor MiMo-V2.6-Pro (79%) und GPT-6 Luna (maximal 78%).
➤ Mehr als 4-mal höhere Kosten pro Aufgabe als bei Modeln mit ähnlicher Intelligenz: Mistral Large 4 Preview kostet 1,13 Dollar pro Aufgabe mit dem Standardpreis von 1,36/$4,18 pro 1 Mio. Eingabe-/Ausgabetoken und 0,14 Dollar pro 1 Mio. gespeicherte Eingabetoken. In den ersten zwei Wochen wird Mistral Large 4 Preview mit einem 50%-rabatt angeboten, wodurch die Kosten pro Aufgabe auf 0,57 Dollar sinken. Das ist immer noch teurer als GLM-5.3-Flash (0,25 Dollar) und DeepSeek V4.1 Flash (maximal 0,27 Dollar).
➤ Starke Dokumenten- und Bildrechnung: Die Vorhersage des Mistral Large 4 erzielt 19% auf GDP.pdf, gleichauf mit MiMo-V2.6-Pro (19%) und hinter Kimi K3 (22%). Dies ist eine Verbesserung von 18 Punkten gegenüber Mistral Large 3, teilweise durch Verbesserungen in ihrer API, die nun 100 Bilder pro Anfrage akzeptiert, im Vergleich zu 8 für die vorherigen Mistral-Modelle.
Schlüsselmodelldetails:
➤ Kontextfenster: 512k Tokens
➤ Multimodalität: Eingabe von Text und Bild, mit Ausgabe von Text
➤ Preise: $1,36/$4,18 pro 1 Mio. Eingabe/Ausgabe-Tokens ($0,14 pro 1 Mio. gespeicherte Eingabe-Tokens), mit 50% Rabatt in den ersten zwei Wochen ($0,68/$2,09)
➤ Verfügbarkeit: Forschungsöffentliche Vorprüfung der Mistral-API, mit offenen Gewichten geplant bis Ende Oktober

