Première main

Première main: Partez du document original, de sa date, de son périmètre et de ses révisions. Une source directe établit ce qui a été annoncé, pas une validation indépendante. Page 21 sur 43

851 actualitésS’abonner au RSS ↗

2026-09-03

10 actualités
千问 QwenModèles

E-Commerce Bench : gestion à long terme, évaluation multidimensionnelle

Au cours des dernières années, le mode d'évaluation des agents consistait globalement à fixer un objectif, que le modèle s'efforçait d'atteindre en un nombre limité de tours. Par exemple, trouver un trésor dans un labyrinthe, produire un rapport ou corriger un morceau de code. La performance du modèle est alors évaluée selon la qualité du livrable ou le degré d'achèvement de la tâche, et ce type d'évaluation comporte souvent un état de terminaison naturelle explicite. Les tâches à long terme du monde réel n'ont pour la plupart pas d'état de terminaison naturelle explicite, par exemple la prévision météorologique, le trading d'actions ou la gestion commerciale. Tout comme une boutique en ligne ne sera pas « gérée avec succès » un certain matin : le stock accumulé le mois dernier, le prix négocié avant-hier et l'activité promotionnelle d'hier influenceront tous

Lire ici Lire la source
千问 QwenModèles

Qwen-Drive-1.0 : une exploration préliminaire vers un modèle fondationnel vision-langage pour la conduite autonome

Nous proposons Qwen-Drive-1.0. Il s'agit du premier modèle fondationnel vision-langage pour la conduite autonome qui unifie la perception 3D et le question-réponse visuel dès la phase de pré-entraînement, puis s'étend à la planification de mouvement, tout en conservant l'architecture VLM pré-entraînée inchangée de bout en bout. Le modèle repose sur Qwen3.5-4B, nativement multimodal, et ajoute deux modules externes. La tête de perception BEV sert de sonde 3D explicite et inspectable, et réalise conjointement la détection d'objets 3D, la prédiction d'Occupancy sémantique et la segmentation de carte BEV. L'expert en planification génère les trajectoires futures du véhicule ego par correspondance de flux. Grâce à un entraînement par étapes, nous améliorons significativement les capacités de conduite autonome du VLM généraliste, et nous validons sa faisabilité sur les tâches de perception 3D, de question-réponse visuel de conduite et de planification de mouvement, formant ainsi un modèle vision-langage unifié pour la conduite autonome, qui fournit une nouvelle génération de base VLM pour l'adaptation aux scénarios de conduite.

Lire ici Lire la source

2026-09-02

9 actualités

2026-09-01

6 actualités

Le RSS contient les versions de lecture complètes et à jour dans cette langue, avec leurs sources.