Arena · X

Wir haben den Jev Router von @typesafeai in Agent Arena bewertet.

Wir haben Jev Router von @typesafeai in Agent Arena getestet. Unsere Tests, die mehr als 4.700 realistische agentische Sitzungen umfassen, zeigen: 1. Jev Router verbessert die aktuelle Pareto-Grenze nicht. Im Vergleich…

Bildquelle · Arena · X

Wir haben den Jev Router von @typesafeai in Agent Arena bewertet.

Unsere Tests, die mehr als 4.700 realistische Agent-Sessions umfassen, zeigen:

1. Der Jev Router verbessert nicht die aktuelle Pareto-Grenze. Im Vergleich zu DeepSeek V4.1 Flash (Max) mit ähnlichen Leistungen kostet die Lösung 38 % mehr und die mittlere Modellanfrage-Latenz ist 1,7x höher.

2. Allerdings führt es in der Regel zu Pareto-effizienten Modellen. Das meist gewählte LLM ist DeepSeek V4.1 Flash, wobei GPT-6.1 Sol und GPT-6 Luna ebenfalls häufig als Optionen auftreten.

3. Die Stärke des Schlüssels des Jev Router ist die Steuerbarkeit. Sein Score von +10% entspricht fast dem von Claude Opus 5,5 (Hoch) (+10,48). Dies unterstreicht den Vorteil der effektiven Routing-Logik von Jev, um auf stärkere LLM zu reagieren, als Reaktion auf die Benutzerfeedback.

Mehr Einblicke im Thread unten.

Originalquelle

Arena · X

Hinweise zum Inhalt

Originalveröffentlichung und Rechte liegen bei der Quelle.

Maschinelle Übersetzung · Original beachten