Aller au contenu

Qwen

Open source Multimodal Génération de texte
Réserver un appel → Site Documentation API
Description

Qwen s’adresse aux projets auto-hébergés qui ont besoin de plus que du texte : lire des documents, transcrire de l’audio et reclasser des résultats sans jamais sortir du réseau.

Les modèles disponibles

Modèle Identifiant d'API Contexte Ce qu'il fait
Qwen3.8 Max qwen3.8-max non publié Le modèle de tête, texte et compréhension d'images.
Qwen3.7 Plus qwen3.7-plus non publié L'échelon intermédiaire, également multimodal.
Qwen3.8 Flash qwen3.8-flash non publié La version rapide, pour le volume.
Qwen3.5 Omni Plus qwen3.5-omni-plus non publié Texte, image, audio et vidéo dans un seul modèle. Une variante temps réel existe.
Qwen Audio 3.0 qwen-audio-3.0-asr-flash-streaming non publié Reconnaissance vocale en flux ; des variantes traitent les fichiers et la synthèse.
Qwen Image 3.0 Pro qwen-image-3.0-pro non publié Génération d'images.
text-embedding-v4 text-embedding-v4 non publié Vectorisation ; un modèle qwen3-rerank complète pour le reclassement.

Liste vérifiée le 7 septembre 2026 dans la documentation de l'éditeur. Les catalogues de modèles changent vite : reportez-vous à elle avant de vous engager.

Services et endpoints

Model Studio

La plateforme d'Alibaba Cloud, qui sert toute la gamme derrière une clé unique.

Poids publiés

Une grande partie du catalogue se télécharge depuis Hugging Face et s'héberge où l'on veut.

Audio et vision

Reconnaissance vocale, synthèse, conversation en direct, compréhension d'images et de vidéos.

Embeddings et rerank

Les deux briques d'une recherche documentaire, dans la même gamme.

L'avis de Bienfait

Qwen arrive rarement par la porte de l'API d'Alibaba, presque toujours par celle de l'open source. C'est la gamme que nos clients croisent sans le savoir : quand un projet auto-héberge un modèle en 2026, il y a une chance sur trois que ce soit un Qwen.

Ce qui le rend intéressant

L'étendue. La plupart des familles open source couvrent le texte et s'arrêtent là. Qwen publie aussi la vision, l'audio et le reclassement, donc une chaîne documentaire complète tient sur une seule famille de modèles, hébergée sur une seule machine, sans appel sortant.

Sur un dossier où l'exigence est « rien ne sort du réseau », c'est ce qui fait la différence entre un projet réalisable et un projet où il manque toujours une brique.

Les tailles comptent plus que la marque

Les petites versions tournent sur un serveur ordinaire, sans carte graphique dédiée. Elles suffisent au classement et à l'extraction, qui sont l'essentiel de ce qu'on demande à un modèle dans une automatisation. On ne loue une machine GPU que pour les modèles de tête, quand la mesure prouve que le petit ne suffit pas.

La réserve, la même que pour DeepSeek

L'API hébergée est en Chine. Nous ne la proposons pas pour des données personnelles. Les poids, eux, ne posent pas cette question : un modèle Qwen tournant sur un serveur français est un fichier de calcul, pas un service tiers. C'est ainsi que nous l'employons.

Passons à l'action

Rencontrez notre équipe d'experts.

Discutez de votre projet Qwen avec nos experts, sans engagement.

Réserver un appel → Voir tous les modèles d'IA
Newsletter
BienVu, notre newsletter

Un cas concret de donnée ou d'automatisation, deux fois par mois.

Deux envois par mois, pas un de plus. Désinscription en un clic.

Intégrations Modèles d'IA Outils Nous rejoindre
Réserver un appel Accéder au Salon

Nantes · Marseille · Paris. Réponse sous 24 h ouvrées.