
Qwen3.8-Omni-Flash est présenté comme la première modèle multimodale de Qwen, développée pour les agents IA. Selon The Decoder, elle traite l'audio et la vidéo simultanément et utilise elle-même des outils pour le montage de vidéoblogs, la traduction de clips et le résumé de films.
Lors des tests audiovisuels, le modèle approche presque les résultats de Gemini 3.8 Flash, tandis que son API est nettement moins chère, selon la description publiée par The Decoder. Les prix et les scores exacts dans le pack de sources disponible ne sont pas indiqués.
La valeur pratique de cette nouvelle réside dans l'accroissement de la concurrence des prix sur le marché des modèles multimodaux pour des scénarios agentiels. Cependant la source est présentée uniquement avec des métadonnées et un synopsis, donc la comparaison ne peut être considérée comme pleinement confirmée par des tests indépendants.
commentaire éditorial
Pourquoi c’est important
Conséquence probable — intensification de la concurrence dans les API multimodales et intérêt pour les agents travaillant avec l'audio et la vidéo. Le prochain signal vérifiable sera les tarifs publiés et les résultats de tests reproductibles. Une incertitude majeure persiste en raison de l'absence de source primaire et de données détaillées.