Pendant que l’attention reste largement concentrée sur OpenAI, Google ou Anthropic, Alibaba poursuit sa montée en puissance avec Qwen. Son nouveau Qwen3.8-Omni-Flash peut analyser du texte, des images, de l’audio et de la vidéo dans un même contexte, jusqu’à un million de tokens. Mais son véritable argument pourrait être ailleurs : le prix. Avec des tarifs particulièrement agressifs, Alibaba veut aussi imposer Qwen par l’économie des usages IA.
Qwen3.8-Omni-Flash, un modèle pour tout analyser
Lancé à la mi-septembre 2026, Qwen3.8-Omni-Flash appartient à la famille de modèles Qwen développée par Alibaba Cloud. Il accepte quatre grands types de contenus en entrée : texte, images, audio, vidéo
La sortie reste essentiellement textuelle. Le modèle dispose également d’une fenêtre de contexte allant jusqu’à un million de tokens, du function calling et de capacités agentiques. Attention toutefois à une formulation que l’on retrouve parfois dans les annonces : Qwen3.8-Omni-Flash n’est pas le premier modèle omnimodal de Qwen. Qwen3-Omni traitait déjà texte, image, audio et vidéo.
La nouveauté tient davantage à l’amélioration des performances, à l’approche agentique et surtout à la réduction du volume de tokens nécessaires pour analyser de longs contenus audiovisuels.
🎬 L’IA ne regarde plus forcément toute la vidéo
C’est probablement l’évolution la plus intéressante. Lorsqu’un utilisateur pose une question sur une vidéo de plusieurs heures, le modèle n’a pas nécessairement besoin d’analyser chaque seconde avec le même niveau de détail.
Qwen3.8-Omni-Flash peut identifier les passages susceptibles de contenir l’information recherchée puis concentrer son analyse sur ces séquences. Selon Alibaba, sur OmniVideoBench, le nombre moyen de tokens utilisés par requête passe de 145 736 à 79 117, soit environ 45,7 % de tokens en moins. Dans le même temps, le score annoncé passe de 63,4 à 67,8. Ces résultats restent toutefois ceux publiés par Alibaba et devront être confrontés à des benchmarks indépendants.
💰 Qwen attaque surtout par les prix
C’est là que la stratégie d’Alibaba devient particulièrement visible.
Tarifs de Qwen3.8-Omni-Flash
| Usage | Prix annoncé |
|---|---|
| Entrée | 0,15 $ / million de tokens |
| Sortie | 0,47 $ / million de tokens |
| Lecture du cache | 0,016 $ / million de tokens |
À ces niveaux de prix, Alibaba vient directement concurrencer les modèles Flash et autres modèles optimisés pour les gros volumes.
Qwen face à Gemini Flash
À titre indicatif, voici l’écart avec le tarif standard affiché pour Gemini 3.8 Flash à l’automne 2026.
| Modèle | Entrée / 1 M tokens | Sortie / 1 M tokens |
|---|---|---|
| Qwen3.8-Omni-Flash | 0,15 $ | 0,47 $ |
| Gemini 3.8 Flash | 0,75 $ | 3,75 $ |
Sur le tarif brut du token, Qwen apparaît donc environ 5 fois moins cher en entrée et près de 8 fois moins cher en sortie.
Mais cette comparaison doit être maniée avec précaution. Une minute de vidéo ou d’audio n’est pas nécessairement convertie en un nombre identique de tokens chez chaque fournisseur. Le véritable indicateur devient donc le coût d’une tâche terminée, et non simplement le prix affiché du million de tokens. Alibaba annonce d’ailleurs une réduction supérieure à 98 % du coût de traitement audio et à 93 % pour l’audio-vidéo par rapport à Qwen3.5-Omni-Plus. Là encore, il s’agit de chiffres du constructeur.
Le prix devient une arme dans la bataille des modèles IA
Qwen3.8-Omni-Flash n’est pas un cas isolé. Alibaba multiplie les modèles positionnés à quelques dizaines de centimes par million de tokens, tandis que DeepSeek suit depuis plusieurs générations une stratégie comparable. Une autre bataille se joue donc derrière les benchmarks.
Ce n’est plus seulement : « Quel est le meilleur modèle ? »
Mais également : « Quel niveau de performance puis-je obtenir pour un euro dépensé ? »
Cette question prend une importance considérable lorsque des agents effectuent des centaines de requêtes, que plusieurs modèles interviennent dans une même chaîne ou que l’IA doit analyser des milliers d’heures d’audio et de vidéo. Le modèle le moins cher par requête peut alors finir par devenir le plus intéressant économiquement, même s’il n’est pas numéro un dans tous les benchmarks.
⚠️ Qwen est chinois : un paramètre à intégrer
Qwen appartient à Alibaba, groupe chinois. Cela ne signifie pas qu’il faut automatiquement écarter le modèle. Cela signifie en revanche qu’il faut intégrer la localisation du fournisseur et le traitement des données dans l’analyse. Alibaba Cloud propose notamment Qwen3.8-Omni-Flash depuis sa région Francfort, en Allemagne. Mais la localisation d’un serveur en Europe ne suffit pas à répondre à toutes les questions liées au RGPD.
La Chine ne bénéficie pas d’une décision générale d’adéquation de la Commission européenne concernant les transferts de données personnelles. Cela ne signifie pas qu’un service chinois est interdit. Cela signifie que le cadre contractuel et les mécanismes de transfert doivent être examinés avec attention, notamment lorsque des données sensibles, stratégiques ou personnelles sont traitées. Et ce réflexe ne devrait d’ailleurs pas être réservé aux acteurs chinois. La même logique doit s’appliquer à tout fournisseur non européen.
Qwen n’est plus un acteur secondaire
Avec Qwen3.8-Omni-Flash, Alibaba confirme une stratégie désormais claire : combiner multimodalité, très grandes fenêtres de contexte, capacités agentiques et tarifs particulièrement bas. Qwen doit donc désormais être regardé aux côtés de Gemini, Claude, OpenAI, Mistral ou DeepSeek dans les comparatifs de modèles. La bataille des IA ne se jouera probablement pas uniquement sur le modèle capable de gagner trois points sur un benchmark.
Elle se jouera aussi sur le coût réel d’une tâche, la vitesse, la consommation de tokens, l’intégration dans les outils et la gouvernance des données.
En savoir plus
Alibaba Cloud – Qwen3.8-Omni-Flash
https://www.alibabacloud.com/help/en/model-studio/qwen3-8-omni-flash / Qwen3.8-Omni-Flash chez Alibaba Cloud/ Documentation Qwen3.8-Omni-Flash
Alibaba Cloud – Présentation de Qwen3.8-Omni-Flash
https://www.alibabacloud.com/blog/qwen3-8-omni-flash-omni-senses–agentic-delivery-_603580
Tarifs Alibaba Cloud Model Studio
IA Pratique – Qwen3-Omni, l’IA d’Alibaba qui voit, entend, lit et parle
https://iapratique.com/qwen3-omni-lia-dalibaba-qui-voit-entend-lit-et-parle-et-en-open-source/1344
IA Pratique : Les IA frontier de l’été 2026
IA Pratique : DeepSeek casse le compteur des coûts avec V4-Flash
#Qwen #Alibaba #IA #LLM #Multimodal #IntelligenceArtificielle #Gemini #DeepSeek #Data #IAPratique