Mistral Large 4 de @MistralAI est désormais dans l'Arène !
Rendez-vous dans l'Agent Arena pour le tester, et vos votes façonneront son évaluation. Les scores arrivent bientôt.
Dans l'Agent Arena, nous évaluons les modèles sur des millions de tâches agentiques réelles à long terme. Les modèles peuvent accéder à la recherche web, au système de fichiers et aux outils de terminal pour accomplir des flux de travail complexes. Le classement mesure la performance des modèles sur les résultats par rapport au modèle moyen en utilisant une méthodologie de traçage causal.
Mistral Large 4 est également disponible dans la Code Arena : WebDev, Text et Vision.

