Artificial Analysis · X

Mistral ha lanzado Mistral Large 4, que obtiene un puntaje de 38 en el Índice de Inteligencia de Análisis Artificial; Francia vuelve a ser…

Mistral ha lanzado Mistral Large 4, que obtiene un puntaje de 38 en el Índice de Inteligencia de Análisis Artificial; Francia vuelve a tener el modelo más inteligente fuera de Estados Unidos y China. @MistralAI ha…

Fuente de la imagen · Artificial Analysis · X

Mistral ha lanzado Mistral Large 4, que obtiene un puntaje de 38 en el Índice de Inteligencia de Análisis Artificial; Francia vuelve a tener el modelo más inteligente fuera de Estados Unidos y China

@MistralAI ha lanzado Mistral Large 4 en una vista previa pública para investigación, con planes de lanzar los pesos del modelo de 1T parameter (49B activo) a finales de octubre. Logra 38 puntos en el Índice de Inteligencia Analítica Artificial, comparable a GPT-6 Luna (máx. 38) y DeepSeek V4.1 Flash (máx. 39). También alcanza el 50% en el Índice Cibernético de Análisis Artificial, nivel equivalente a GLM-5.3-Flash, y por encima de modelos como Kimi K3 y DeepSeek V4.1 Flash (máx.).

Resultados clave de benchmark para la versión preliminar de Mistral Large 4:

➤ El modelo más inteligente fuera de EE. UU. y China: Mistral Large 4 Preview obtiene un puntaje de 38 en el Índice de Inteligencia, comparable con DeepSeek V4.1 Flash (máx. 39) y GPT-6 Luna (máx. 38). Esto lo convierte en el modelo más inteligente fuera de EE. UU. y China, por delante de países como Corea del Sur y los Emiratos Árabes Unidos

➤ Nivel con GLM-5.3-Flash en la capacidad de defensa cibernética: Mistral Large 4 Preview obtiene un 50 en el Índice Cibernético de Análisis Artificial, igual que GLM-5.3-Flash (50), y por detrás de MiMo-V2.6-Pro (56). Una vez que se publiquen sus pesos, ocupará una posición entre los tres mejores modelos de pesos abiertos en el Índice Cibernético. Su mejor resultado se da en CyberGym-E2E-AA, donde obtiene un 82%, por delante de MiMo-V2.6-Pro (79%) y GPT-6 Luna (máximo, 78%).

➤ Más del 4 veces el costo por tarea de los modelos de pesos abiertos con inteligencia similar: Mistral Large 4 Preview cuesta $1.13 por tarea de Índice de Inteligencia, con un precio estándar de $1.36/$4.18 por 1M tokens de entrada/salida, y $0.14 por 1M tokens de entrada en caché. Durante las primeras dos semanas, Mistral Large 4 Preview estará disponible con un descuento del 50% al lanzar, lo que reduce su costo por tarea a $0.57. Esto sigue siendo más costoso que GLM-5.3-Flash ($0.25) y DeepSeek V4.1 Flash (máximo, $0.27).

➤ Razonamiento sólido en documentos e imágenes: la previsualización de Mistral Large 4 obtiene un 19% en GDP.pdf, igual que MiMo-V2.6-Pro (19%), pero por debajo de Kimi K3 (22%). Esto representa una mejora de 18 puntos respecto a Mistral Large 3, parcialmente impulsada por mejoras en su API, que ahora acepta 100 imágenes por solicitud, en comparación con 8 para los modelos anteriores de Mistral.

Detalles del modelo clave:

➤ Ventana de contexto: 512k tokens

➤ Multimodalidad: Entrada de texto e imágenes, con salida de texto

➤ Precios: $1.36/$4.18 por 1M tokens de entrada/salida ($0.14 por 1M tokens de entrada en caché), con un 50% de descuento durante las primeras dos semanas ($0.68/$2.09)

➤ Disponibilidad: Investigación de vista previa pública en la API de Mistral, con pesos abiertos planificados para finales de octubre

Fuente original

Artificial Analysis · X

Notas sobre el contenido

La publicación original y los derechos pertenecen a la fuente.

Traducción automática · Consulte el original