Artificial Analysis · X

Ling 3.1 Flash logra grandes avances en inteligencia respecto a su predecesor, obteniendo un puntaje de 41 en el Índice de Inteligencia de…

Ling 3.1 Flash logra grandes avances en inteligencia respecto a su predecesor, obteniendo una puntuación de 41 en el Índice de Inteligencia de Análisis Artificial, con mejoras especiales en las capacidades agenticas.…

Fuente de la imagen · Artificial Analysis · X

Ling 3.1 Flash logra grandes avances en inteligencia respecto a su predecesor, obteniendo una puntuación de 41 en el Índice de Inteligencia de Análisis Artificial, con mejoras específicas en las capacidades agentes.

@AntLingAGI ha lanzado Ling 3.1 Flash, un modelo de razonamiento con 560B parámetros totales, 25B parámetros activos y una ventana de contexto de 1M tokens. Obtiene un puntaje de 41 en el Índice de Inteligencia de Análisis Artificial v4.3, en comparación con los 20 obtenidos por Ling 3.0 Flash, lanzado en agosto. Se espera que Ling 3.1 Flash tenga pesos abiertos, y el Grupo Ant liberará los pesos pronto.

Resultados clave:

➤ Ling 3.1 Flash mejora las capacidades agenticas en comparación con su predecesor. Con un GDPval-AA v2 Elo de 1,622 y un AA-Briefcase Elo de 1,400, el modelo compite con modelos similares como GLM-5.3-Flash, Gemini 3.8 Flash (alto) y DeepSeek V4.1 Flash (Max). Ling 3.1 Flash también muestra mejoras notables en AutomationBench-AA (62%) y Terminal-Bench v4.0 (33%).

➤ Ling 3.1 Flash obtiene +2 puntos en AA-Omniscience, lo que representa una mejora de 22 puntos respecto a Ling 3.0 Flash (-18). En comparación con su predecesor, la tasa de precisión aumentó de 18% a 29%, mientras que la tasa de alucinaciones disminuyó de 44% a 38%, manteniendo un mismo índice de intentos (56% a 58%). Esto demuestra que la ganancia proviene principalmente del conocimiento adicional, no de evitar más esfuerzos. Para comparación, DeepSeek V4.1 Flash (Max) tiene una tasa de alucinaciones del 97%.

➤ Ling 3.1 Flash es un modelo más grande que su predecesor, con un precio correspondiente, pero más eficiente en términos de tokens. Tiene 560B de parámetros totales y 25B de parámetros activos, en comparación con 124B y 5.1B en Ling 3.0 Flash. Su precio es de $0.30 por $0.90 por 1M tokens de entrada/salida, en comparación con $0.075 por $0.22. Se utilizaron 218M tokens de salida para ejecutar el Índice de Inteligencia, lo que representa un 16% menos que en Ling 3.0 Flash (261M).

➤ Ling 3.1 Flash tiene un costo más alto por tarea que algunos competidores, pero sigue estando en el cuadrante más atractivo. Ling 3.1 Flash cuesta $0.99 por tarea, muy por encima de GLM-5.3-Flash ($0.42) y DeepSeek V4.1 Flash (Max, $0.32), pero por debajo de Gemini 3.8 Flash (High) que tiene un costo de $1.24.

Detalles adicionales del modelo:

➤ Tamaño: 560B de parámetros totales, 25B activos

➤ Ventana de contexto: 1M tokens

➤ Precios: $0.30 por 1M tokens de entrada y $0.90 por 1M tokens de salida, con entradas almacenadas a $0.06 por 1M (descuento del 80%)

➤ Disponibilidad: Accesible a través de Novita AI, con los pesos llegando pronto

Fuente original

Artificial Analysis · X

Notas sobre el contenido

La publicación original y los derechos pertenecen a la fuente.

Traducción automática · Consulte el original