Qwen 3.8-27B : une IA open source qui tourne sur un seul PC
Le 14 août 2026, l’équipe Qwen d’Alibaba a publié Qwen 3.8-27B, un modèle d’IA de 27 milliards de paramètres, capable de lire du texte, des images et des vidéos, distribué gratuitement sous licence Apache 2.0 — donc utilisable et modifiable commercialement sans redevance. Compressé, il tient sur une carte graphique de 24 Go, c’est-à-dire une station de travail de PME. Deux jours après l’annonce d’une forte hausse des tarifs de DeepSeek, c’est un rappel utile : une entreprise n’est pas obligée de louer son intelligence artificielle à l’heure, elle peut aussi la faire tourner chez elle.
Ce qu’Alibaba a publié exactement
La fiche officielle sur Hugging Face détaille un modèle « dense » (tous les paramètres sont sollicités à chaque réponse), multimodal, avec un mode de raisonnement activé par défaut et réglable sur trois niveaux (faible, moyen, très élevé). Les points clés :
- 27 milliards de paramètres, architecture hybride combinant attention classique et « Gated DeltaNet » ;
- 262 144 tokens de contexte natif (l’équivalent de plusieurs livres), extensible à 1 million de tokens avec la méthode YaRN ;
- texte, images et vidéos en entrée — jusqu’à des vidéos de plusieurs heures selon la fiche ;
- licence Apache 2.0 : usage commercial, modification et redistribution libres ;
- poids téléchargeables sur Hugging Face et ModelScope ; une version hébergée avec 1 million de tokens de contexte est annoncée sur Qwen Cloud.
Alibaba a publié le même jour un modèle géant, Qwen3.8-2.4T-A95B, pour sa gamme « Max ». Mais c’est le 27B qui intéresse les entreprises : d’après The Decoder, Alibaba affirme qu’il « surpasse le Qwen3.7-Plus, pourtant plus volumineux, dans les tâches de code et de bureautique ».
Des scores qui rivalisent avec des modèles bien plus gros
Les tableaux publiés par Qwen sur la fiche du modèle comparent Qwen 3.8-27B à son prédécesseur Qwen 3.6-27B et à Claude Opus 4.6 d’Anthropic. Sur SWE-bench Pro (résolution de tickets logiciels réels), le 27B atteint 61,7 contre 53,5 pour la génération précédente et 53,4 pour Opus 4.6. Sur OSWorld (pilotage d’un ordinateur par l’IA), il passe de 63,9 à 84,3. Sur Terminal Bench, il monte de 63,4 à 73,0, mais reste derrière Opus 4.6 (78,2) ; sur GPQA Diamond (questions scientifiques de niveau doctorat), il obtient 89,2 contre 91,3 pour Opus. Ces chiffres sont ceux de l’éditeur : ils demandent, comme toujours, confirmation par des tests indépendants. Mais l’ordre de grandeur est clair : un modèle qui tient sur une machine de bureau fait aujourd’hui ce qu’un modèle payant haut de gamme faisait il y a quelques mois.
Quel matériel pour le faire tourner ?
Le mot « local » ne veut pas dire « n’importe quel portable ». Selon le guide matériel de Yotta Labs, le modèle en pleine précision (BF16) réclame environ 56 Go de mémoire vidéo, soit une carte professionnelle de 80 Go. En version FP8, il descend à 28 Go ; en version compressée à 4 bits (formats GGUF ou AWQ), il tient dans 14 à 17 Go, ce qui le rend exécutable sur une RTX 4090 ou 5090 grand public — une machine à quelques milliers de francs, pas un datacenter. Attention toutefois : la mémoire nécessaire grimpe avec la longueur des documents traités, et les grands contextes de 262 000 tokens exigent nettement plus que le minimum.
Ce que ça change concrètement pour vous
Vos données ne quittent plus l’entreprise
Pour un cabinet, une fiduciaire, un service RH ou une PME soumise à la nLPD suisse et au RGPD, c’est l’argument principal : un modèle hébergé sur votre serveur traite contrats, dossiers clients ou données médicales sans qu’un octet ne parte chez un fournisseur américain ou chinois. La question « où vont mes données ? » disparaît par construction.
Un coût fixe, à l’abri des hausses de tarifs
La hausse de DeepSeek entrée en vigueur ce 16 août (jusqu’à quatre fois le prix en heures de pointe, rapporte Engadget) montre que le tarif d’une API peut changer du jour au lendemain. Un modèle open source, une fois téléchargé, ne coûte que l’électricité et le matériel. Pour un volume régulier — tri d’e-mails, extraction de données de factures, résumé de rapports — le calcul mérite d’être fait.
Ce n’est pas gratuit pour autant
Faire tourner un modèle chez soi suppose quelqu’un pour l’installer, le maintenir, le mettre à jour et surveiller sa qualité. Et pour les tâches les plus complexes, les modèles hébergés haut de gamme gardent une longueur d’avance. La bonne stratégie n’est pas « tout en local » ou « tout dans le cloud », mais un mélange choisi tâche par tâche.
Peut-on utiliser Qwen 3.8-27B dans un produit commercial ?
Oui. La licence Apache 2.0 autorise l’usage commercial, la modification et la redistribution sans redevance, à condition de conserver la mention de licence. C’est l’une des licences les plus permissives du logiciel libre — bien plus souple que certaines licences « open weight » qui limitent le nombre d’utilisateurs.
Un modèle chinois pose-t-il un risque de confidentialité ?
Pas lorsqu’il tourne en local : les poids du modèle sont des fichiers de nombres, exécutés sur votre machine, sans connexion vers l’éditeur. Le risque de fuite de données concerne l’usage via API hébergée, quel que soit le pays du fournisseur. En revanche, les biais et le comportement du modèle restent ceux définis par son entraînement — d’où l’intérêt de le tester sur vos propres cas avant de l’adopter.
Comprendre la différence entre un modèle loué via API et un modèle open source hébergé chez soi, et savoir lequel choisir pour quel processus, fait partie des réflexes que Vincent Lévi et son équipe transmettent dans leurs formations IA, de la prise en main individuelle (IA Académie) à l’automatisation des équipes (Business IA). Pour évaluer si un modèle local a du sens pour votre entreprise, écrivez directement à l’équipe : réponse sous 48 heures.




