Wir haben den Jev Router von @typesafeai in Agent Arena bewertet.
Unsere Tests, die mehr als 4.700 realistische Agent-Sessions umfassen, zeigen:
1. Der Jev Router verbessert nicht die aktuelle Pareto-Grenze. Im Vergleich zu DeepSeek V4.1 Flash (Max) mit ähnlichen Leistungen kostet die Lösung 38 % mehr und die mittlere Modellanfrage-Latenz ist 1,7x höher.
2. Allerdings führt es in der Regel zu Pareto-effizienten Modellen. Das meist gewählte LLM ist DeepSeek V4.1 Flash, wobei GPT-6.1 Sol und GPT-6 Luna ebenfalls häufig als Optionen auftreten.
3. Die Stärke des Schlüssels des Jev Router ist die Steuerbarkeit. Sein Score von +10% entspricht fast dem von Claude Opus 5,5 (Hoch) (+10,48). Dies unterstreicht den Vorteil der effektiven Routing-Logik von Jev, um auf stärkere LLM zu reagieren, als Reaktion auf die Benutzerfeedback.
Mehr Einblicke im Thread unten.

