Ling 3.1 Flash erzielt bei der Intelligenz eine deutliche Verbesserung gegenüber seinem Vorgänger, indem es im Index für künstliche Analyse-Intelligenz 41 Punkte erreicht und insbesondere die Fähigkeiten des Agenten verbessert.
@AntLingAGI hat Ling 3.1 Flash veröffentlicht, ein reasoningmodell mit insgesamt 560B Parametern, 25B aktiven Parametern und einem Kontextfenster von 1M Tokens. Es erzielt einen Wert von 41 im Artificial Analysis Intelligence Index v4.3, gegenüber 20 bei Ling 3.0 Flash, das im August veröffentlicht wurde. Es wird erwartet, dass Ling 3.1 Flash offene Gewichte hat, wobei die Ant-Gruppe die Gewichte bald veröffentlichen wird.
Wichtige Ergebnisse:
➤ Ling 3.1 Flash verbessert die agentischen Fähigkeiten gegenüber seinem Vorgänger. Mit einem GDPval-AA v2 Elo von 1.622 und einem AA-Briefcase Elo von 1.400 kann das Modell Konkurrenz zu peer-Modellen wie GLM-5.3-Flash, Gemini 3.8 Flash (hoch) und DeepSeek V4.1 Flash (Max) bieten. Ling 3.1 Flash zeigt außerdem erhebliche Verbesserungen in AutomationBench-AA (62%) und Terminal-Bench v4.0 (33%).
➤ Ling 3.1 Flash erzielt +2 Punkte bei AA-Omniscience, was eine Verbesserung von 22 Punkten gegenüber Ling 3.0 Flash (-18) bedeutet. Im Vergleich zu seinem Vorgänger stieg die Genauigkeit auf 29% von 18%, während die Halluzinationstemperatur von 44% auf 38% fiel – bei einem ähnlichen Versuchrate von 56% auf 58%. Dies zeigt, dass der Vorteil hauptsächlich aus dem Wissen über mehr Informationen resultiert, nicht aus einer reduzierten Aktivität. Als Vergleich: DeepSeek V4.1 Flash (Max) weist eine Halluzinationstemperatur von 97% auf.
➤ Ling 3.1 Flash ist ein größerer Modell als sein Vorgänger, mit entsprechend höherem Preis, aber effizienter in Bezug auf Tokens. Es verfügt über insgesamt 560B und aktive Parameter von 25B – im Vergleich zu 124B und 5,1B bei Ling 3.0 Flash. Der Preis liegt bei $0,30 / $0,90 pro 1M Eingabe-/Ausgabetokens – im Vergleich zu $0,075 / $0,22. Für die Ausführung des Intelligence Index wurden 218M Ausgabetokens verwendet, was 16% weniger ist als bei Ling 3.0 Flash (261M).
➤ Ling 3.1 Flash hat einen höheren Kostenaufwand pro Aufgabe als einige Konkurrenten, bleibt aber im attraktivsten Bereich. Ling 3.1 Flash kostet $0,99 pro Aufgabe, was deutlich über GLM-5.3-Flash ($0,42) und DeepSeek V4.1 Flash (Max, $0,32) liegt, aber unter Gemini 3.8 Flash (High) bei $1,24.
Zusätzliche Modelldaten:
➤ Größe: 560B Gesamtparameter, 25B Aktive
➤ Kontextfenster: 1M Tokens
➤ Preise: $0,30 pro 1M Eingabe-Tokens und $0,90 pro 1M Ausgabe-Tokens, mit gespeicherter Eingabe für $0,06 pro 1M (80% Rabatt)
➤ Verfügbarkeit: Zugänglich über Novita AI, die Gewichte kommen bald.

