
La division de recherche d'Alibaba a publié Qwen-Drive 1.0 —, un modèle qui combine la perception de l'environnement, les réponses aux questions sur la circulation routière et la planification d'itinéraire.
Selon The Decoder, les chercheurs ont démontré que les modèles texte-visuel ne commencent pas automatiquement à comprendre l'espace tridimensionnel; la perception spatiale doit être enseignée de manière ciblée. L'objectif déclaré est de créer un système unique gérant à la fois l'interface embarquée et la conduite.
La portée pratique de ce développement réside dans la tentative de fusionner les fonctions d'aide à la conduite et d'interaction avec les passagers au sein d'un modèle unique. Cependant, la description présentée ne contient aucune donnée sur la précision, les essais sur route ou la sécurité du système; la source note également que l'explication d'un freinage peut ne pas correspondre à la manœuvre effectuée.
commentaire éditorial
Pourquoi c’est important
Conséquence probable : un intérêt accru pour les modèles combinant la conduite automobile et le dialogue avec les passagers. Le prochain signal observable sera la publication des résultats des essais sur route et des vérifications de conformité entre les explications et les actions réelles. Une incertitude substantielle persiste en raison de l'absence, dans le dossier, de données sur les tests, la précision et la sécurité.