Evaluamos el Jev Router por @typesafeai en Agent Arena.
Nuestros pruebas, que abarcan más de 4,700 sesiones reales de agentes, muestran:
1. El Jev Router no mejora la frontera actual de Pareto. Para un rendimiento similar al de DeepSeek V4.1 Flash (Max), la solución cuesta un 38% más y la latencia de solicitud del modelo mediano es 1.7 veces mayor.
2. Sin embargo, en su mayoría, el modelo recorre rutas que son eficientes desde el punto de vista de Pareto. El modelo LLM más elegido es DeepSeek V4.1 Flash, mientras que GPT-6.1 Sol y GPT-6 Luna también son opciones frecuentes.
3. La fuerza clave del router Jev es la capacidad de direccionamiento. Su puntaje de +10% coincide casi con el de Claude Opus 5.5 (Alto) (+10.48). Esto destaca la ventaja de Jev en su enrutamiento efectivo hacia LLM más potentes en respuesta a los comentarios del usuario.
Más información en el hilo de abajo.

