Qwen
Qwen s’adresse aux projets auto-hébergés qui ont besoin de plus que du texte : lire des documents, transcrire de l’audio et reclasser des résultats sans jamais sortir du réseau.
Les modèles disponibles
| Modèle | Identifiant d'API | Contexte | Ce qu'il fait |
|---|---|---|---|
| Qwen3.8 Max | qwen3.8-max | non publié | Le modèle de tête, texte et compréhension d'images. |
| Qwen3.7 Plus | qwen3.7-plus | non publié | L'échelon intermédiaire, également multimodal. |
| Qwen3.8 Flash | qwen3.8-flash | non publié | La version rapide, pour le volume. |
| Qwen3.5 Omni Plus | qwen3.5-omni-plus | non publié | Texte, image, audio et vidéo dans un seul modèle. Une variante temps réel existe. |
| Qwen Audio 3.0 | qwen-audio-3.0-asr-flash-streaming | non publié | Reconnaissance vocale en flux ; des variantes traitent les fichiers et la synthèse. |
| Qwen Image 3.0 Pro | qwen-image-3.0-pro | non publié | Génération d'images. |
| text-embedding-v4 | text-embedding-v4 | non publié | Vectorisation ; un modèle qwen3-rerank complète pour le reclassement. |
Liste vérifiée le 7 septembre 2026 dans la documentation de l'éditeur. Les catalogues de modèles changent vite : reportez-vous à elle avant de vous engager.
Services et endpoints
Model Studio
La plateforme d'Alibaba Cloud, qui sert toute la gamme derrière une clé unique.
Poids publiés
Une grande partie du catalogue se télécharge depuis Hugging Face et s'héberge où l'on veut.
Audio et vision
Reconnaissance vocale, synthèse, conversation en direct, compréhension d'images et de vidéos.
Embeddings et rerank
Les deux briques d'une recherche documentaire, dans la même gamme.
L'avis de Bienfait
Qwen arrive rarement par la porte de l'API d'Alibaba, presque toujours par celle de l'open source. C'est la gamme que nos clients croisent sans le savoir : quand un projet auto-héberge un modèle en 2026, il y a une chance sur trois que ce soit un Qwen.
Ce qui le rend intéressant
L'étendue. La plupart des familles open source couvrent le texte et s'arrêtent là. Qwen publie aussi la vision, l'audio et le reclassement, donc une chaîne documentaire complète tient sur une seule famille de modèles, hébergée sur une seule machine, sans appel sortant.
Sur un dossier où l'exigence est « rien ne sort du réseau », c'est ce qui fait la différence entre un projet réalisable et un projet où il manque toujours une brique.
Les tailles comptent plus que la marque
Les petites versions tournent sur un serveur ordinaire, sans carte graphique dédiée. Elles suffisent au classement et à l'extraction, qui sont l'essentiel de ce qu'on demande à un modèle dans une automatisation. On ne loue une machine GPU que pour les modèles de tête, quand la mesure prouve que le petit ne suffit pas.
La réserve, la même que pour DeepSeek
L'API hébergée est en Chine. Nous ne la proposons pas pour des données personnelles. Les poids, eux, ne posent pas cette question : un modèle Qwen tournant sur un serveur français est un fichier de calcul, pas un service tiers. C'est ainsi que nous l'employons.
Rencontrez notre équipe d'experts.
Discutez de votre projet Qwen avec nos experts, sans engagement.