2026-08-05 · 3 min de lecture

Qwen 3.8 Max et 27B : modèles IA open-weight comparés

Alibaba a lancé Qwen 3.8-Max, un modèle MoE de 2,4T de paramètres, et a annoncé Qwen 3.8-27B pour une utilisation locale. Les deux auront des poids ouverts.

Comparé à Kimi K3 (2,8T de paramètres), Qwen 3.8-Max offre un contexte de 1M et des coûts API significativement inférieurs. Qwen 3.8 Max facture 2,00 $ par million de jetons d'entrée (0,20 $ pour les hits en cache) et 6,00 $ par million de jetons de sortie. Kimi K3 facture 2,90 $–3,00 $ par million de jetons d'entrée (0,30 $ pour les hits en cache) et 14,00 $–15,00 $ par million de jetons de sortie. Cela donne à Qwen un avantage de prix de 2,4x–2,5x sur les jetons de sortie, le rendant plus rentable pour la génération à haut débit et les boucles agentiques itératives. La vitesse est comparable, mais l'efficacité de Qwen lui donne un avantage pour le déploiement en entreprise. Pour l'hébergement autonome, Kimi K3 fournit des poids de modèle ouverts (594 GB MXFP4 quant), permettant aux organisations d'éliminer entièrement les coûts de jetons API en exécutant le modèle sur une infrastructure privée multi-nœuds ou des postes de travail à haute mémoire.

En termes de performances, Kimi K3 excelle dans le raisonnement agentique complexe et l'ingénierie logicielle, menant sur des benchmarks comme FrontierSWE (81,2 % vs. 73,5 %), DeepSWE 1.1 (69,0 % vs. 56,6 %) et Terminal-Bench 2.1 (88,3 vs. 86,6). Il détient également la tête dans le raisonnement académique, surpassant Qwen sur GPQA Diamond (93,5 % vs. 92,6 %), Humanity's Last Exam (56,0 % vs. 43,6 %) et MLS-Bench Lite (48,3 % vs. 41,0 %). Cependant, Qwen 3.8 Max mène dans la vision multimodale et la perception, obtenant des scores plus élevés sur PerceptionBench (63,5 vs. 58,5) et MMMU-Pro (82,3 % vs. 81,6 %), et surpasse Kimi K3 dans l'automatisation informatique et OS avec un score SOTA vérifié de 86,1 % sur OSWorld.

Le modèle 27B, successeur du 3.6-27B, fonctionne quantifié sur une seule GPU (17 Go de VRAM), remplaçant l'ancien modèle pour les déploiements privés. Cela le rend idéal pour le travail agentique sur site, offrant un équilibre entre performance et confidentialité.

CaractéristiqueQwen 3.8-MaxKimi K3Qwen 3.8-27B
Paramètres totaux2,4T2,8T27B
Contexte1M1MÀ définir
Coût API (entrée/sortie)2,00 $/6,00 $2,90 $–3,00 $/14,00 $–15,00 $N/A
DéploiementAPI/OpenAPI/OpenLocal
← Faites défiler vers la droite pour en voir plus →

Les poids ouverts promettent de démocratiser l'IA de pointe. La sortie des poids ouverts est prévue dans la semaine.

Travaillons ensemble

Vous avez besoin de plus d'informations, d'aide pour votre projet ou pour développer une idée?

Qu'il s'agisse d'une question simple, d'un doute rapide ou d'une discussion de 5 minutes, envoyez-moi un message—cela ne coûte rien et je suis toujours prêt à vous aider. J'aime comprendre un problème, être créatif dans les solutions et me concentrer sur des idées simples, fiables et faciles à réaliser rapidement.

Me contacter

Changer de sujet

Choisissez un sujet spécialisé à explorer: