Discutons de votre projet
Un appel de 30 minutes pour cadrer votre cas d'usage IA.
Sans formulaire de qualification, sans engagement. On parle de votre contexte, on identifie ce qui peut bouger vite, on vous dit honnêtement où l'IA n'apportera rien.
Comprendre
Diagnostiquer, acculturer, cadrer avant tout investissement.
Construire
Intégrer et développer les briques opérationnelles.
Pérenniser
Faire durer l'investissement IA dans la durée.
Modèles d'IA
Les grands modèles que nous intégrons.
Applications IA
Les applications IA du quotidien.
Méthodes & briques
Les méthodes qui structurent l'IA.
Solutions AGE
Nos solutions propriétaires.
Services aux personnes
Pourquoi nos technologies pour la santé et le droit.
Industrie & B2B
Pourquoi nos technologies pour l'industrie et l'immobilier.
Print, packaging & création
Pourquoi nos technologies pour la filière print et emballage.
AGE Services
L'entreprise, ses fondateurs, son ADN.
Travailler avec nous
Devenir client, devenir collaborateur.
Qwen est la famille de modèles d’intelligence artificielle développée par Alibaba (Chine). Sa particularité structurelle : une large part de la gamme est diffusée à poids ouverts sous licence Apache 2.0 — paramètres publiquement téléchargeables et auto-hébergeables — couvrant non seulement le texte, mais aussi le code, la vision, l’omnimodal, l’image et l’audio.
Cette ouverture ne couvre cependant pas tout : depuis 2026, les modèles phares les plus récents (la lignée Max) sont devenus propriétaires et accessibles par API uniquement. L’écosystème combine donc des modèles ouverts que l’on installe où l’on veut, et des modèles fermés consommés comme un service.
L’écosystème Qwen s’aborde par trois portes principales — un assistant grand public, une plateforme d’API, et la distribution des poids — complétées par des outils pour développeurs.
Démo officielle de la chaîne Qwen : l’assistant Qwen Chat en interaction multimodale — dialogue par la voix et la vidéo en temps réel (gamme « Omni »).
L’API Model Studio offre une compatibilité avec l’API OpenAI (bascule sans réécrire le code), le fine-tuning, une base de connaissances (RAG), des agents et un mode par lots. Côté développeurs, Qwen Code est un agent de code en ligne de commande (open source), et Qwen-Agent le framework qui sert de moteur à Qwen Chat.
Le catalogue se lit selon deux axes : la modalité (texte, code, vision…) et le régime de licence (ouvert ou propriétaire). Le tableau ci-dessous donne l’état de la gamme.
Deux points d’attention sur l’évolution récente. D’abord, le basculement du flagship vers le fermé : Qwen3.7-Max (mai 2026) et ses variantes Plus sont propriétaires, après une lignée historiquement ouverte. Ensuite, le point de comparaison a changé : l’éditeur positionne désormais ses modèles face à la génération frontière 2026 (Claude Opus 4.6, GLM-5.1), et non plus face à GPT-4o ou Claude 3.5 — toute référence à ces derniers serait périmée.
C’est l’angle le plus distinctif de Qwen : la possibilité de télécharger les modèles et de les exécuter soi-même, sans dépendre d’un service distant. Le chemin est balisé et repose sur des outils standard.
Cette voie a une limite à connaître : elle ne donne accès qu’aux variantes ouvertes. Le modèle phare Qwen3.7-Max étant propriétaire, un déploiement entièrement souverain ne peut pas mobiliser le « meilleur » Qwen du moment, mais des modèles ouverts très capables (jusqu’au MoE 397B-A17B, ou Qwen3-Coder-480B-A35B pour le code).
L’API se facture à l’usage, au million de tokens, avec une particularité : la tarification par paliers de longueur de contexte (plus la requête est longue, plus le tarif au million monte). Grille « internationale », en dollars américains.
Trois leviers réduisent la facture : le traitement par lots (−50 % sur entrée et sortie), le cache de contexte (remise sur les tokens d’entrée mis en cache), et un quota gratuit pour les nouveaux comptes (1 M tokens en entrée + 1 M en sortie, par modèle, pendant 90 jours). Réserves : la grille ci-dessus est la grille « internationale » en USD — la grille Chine continentale (RMB) diffère ; et le tarif du flagship Qwen3.7-Max n’est pas encore publié sur Model Studio à date.
Parce que l’éditeur est chinois, la question de l’origine et de la localisation des données mérite d’être posée — et traitée factuellement, sans verdict.
Régions internationales. L’API Model Studio propose des endpoints hors Chine continentale : Singapour (international), US (Virginie), Hong Kong, et une région Francfort (UE) est mentionnée. Les données y sont stockées hors de Chine continentale et les clés d’API ne sont pas interchangeables entre régions. Certaines fonctions restent toutefois limitées à la Chine (ex. l’API Deep Research, région Pékin).
Auto-hébergement. Les modèles à poids ouverts s’exécutent sur une infrastructure entièrement maîtrisée — on-premises ou chez un hébergeur européen — où aucune donnée ne sort du périmètre.
Le critère d’origine. Pour les secteurs soumis à une règle de filière sur l’origine des composants techniques (défense, santé sensible, données strictement encadrées), l’origine de l’éditeur reste un critère à évaluer, y compris en self-hosting. Les garanties contractuelles UE/RGPD et certifications (HDS, ISO 27001) ne sont pas formalisées sur les pages produit et sont à demander à l’éditeur. La région UE de Model Studio est, à date, à confirmer.
Les briques décrites se combinent en plusieurs usages typiques.
Plusieurs situations justifient d’examiner d’autres options, ou d’exiger des compléments avant de retenir cette solution.
En synthèse, Qwen est un écosystème de modèles largement ouverts (Apache 2.0) couvrant toutes les modalités, dont la singularité tient à l’auto-hébergement souverain : télécharger les poids et les servir sur sa propre infrastructure, à coût d’infrastructure plutôt qu’à l’usage. C’est l’argument décisif pour le traitement de gros volumes et les déploiements maîtrisés. En contrepartie, deux éléments structurent toute décision : les modèles phares récents sont fermés (le meilleur Qwen n’est pas auto-hébergeable), et l’origine chinoise de l’éditeur est un critère à arbitrer pour les secteurs régulés — les garanties de résidence et de conformité étant à demander à l’éditeur plutôt qu’à présumer.
Discutons de votre projet
Sans formulaire de qualification, sans engagement. On parle de votre contexte, on identifie ce qui peut bouger vite, on vous dit honnêtement où l'IA n'apportera rien.