
Alibaba の研究部門は、環境認識、交通に関する質問への回答、経路計画を統合した Qwen-Drive 1.0 — モデルを発表した。
По данным The Decoder, исследователи показали: текстово-визуальные модели не начинают автоматически понимать трехмерное пространство. Пространственное восприятие нужно обучать целенаправленно. Заявленная цель — одна система, которая управляет и бортовым интерфейсом, и вождением.
この開発の実践的な意義は、運転支援機能と乗客との対話機能を単一のモデルに統合しようとする試みにある。しかし、提示された記述には精度、実走試験、あるいはシステムの安全性に関するデータが含まれておらず、情報源はまた、ブレーキの説明が実際の操縦動作と一致しない可能性があると指摘している。
編集部コメント
なぜ重要か
考えられる帰結として、車両制御と乗客との対話を統合するモデルへの関心が高まることが予想される。次に注目すべき指標は、実走試験の結果および説明と実際の行動の適合性を検証したデータの公表となるだろう。テスト、精度、安全性に関するデータがパッケージに欠如している点は、重大な不確実性要因である。