3 août 2026 · 4 min de lecture

Qwen3.8 est open-weight, et une version tient sur votre portable

Il y a deux semaines, je vous parlais de Kimi K3, le premier modèle vraiment haut de gamme que vous pouviez télécharger et garder sur un disque. Je pensais que ça tiendrait le haut de l'affiche un moment. Raté. Alibaba vient de sortir Qwen3.8, et fait la seule chose qu'ils avaient refusée sur leurs deux derniers flagships : ils donnent les poids.

C'est là-dessus qu'il faut s'arrêter. Alibaba affirme que Qwen3.8-Max, leur nouveau modèle de tête, devance Kimi K3 sur les benchmarks qui comptent, et ils l'ouvrent au lieu de l'enfermer derrière une API. Une boîte qui protégeait jalousement ses meilleurs modèles se met à les distribuer.

Voici pourquoi ça compte, sans la soupe de benchmarks.

Il y a deux modèles, et les deux comptent

Qwen3.8-Max, c'est le mastodonte. 2,4 billions de paramètres, mais construit en mixture-of-experts, donc seule une petite partie s'active réellement pour une requête donnée, l'astuce qui garde un truc de cette taille abordable à servir. Il gère le texte, l'image et la vidéo, retient l'équivalent d'un roman en contexte, et il vise le travail long et compliqué : écrire une base de code entière, mener une tâche de recherche sur plusieurs jours. Il est dans la même conversation que les modèles que vous payez une fortune.

Qwen3.8-27B, c'est celui qui m'intéresse le plus, franchement. Des poids ouverts n'ont de sens que si vous pouvez vraiment faire tourner le truc, et c'est la version qui tient sur du matériel que les gens normaux possèdent. S'il suit son prédécesseur, Unsloth l'aura quantizé pour un seul GPU de gaming ou un Mac correct en quelques jours. Pas de cloud, pas d'abonnement, aucune donnée confiée à qui que ce soit. Du quasi haut de gamme posé sur votre propre bureau. C'était de la science-fiction il y a douze mois.

Le passage qui intéresse votre comptable

Le sommet du classement s'est effondré dans le bruit de fond. Sur les vraies tâches, Qwen3.8-Max, Kimi K3 et les flagships payants d'Anthropic et d'OpenAI sont assez proches pour que « lequel est le plus intelligent » ait cessé d'être la question intéressante. « Lequel ne vide pas mon compte » a pris le relais.

Et sur cette question-là, l'écart est énorme.

Modèle Open weights ? Prix API (in / out par M)
Qwen3.8-Max Oui (la semaine prochaine) 2 $ / 6 $
Kimi K3 Oui 3 $ / 15 $
GPT-5.6 Sol Non 5 $ / 30 $
Claude Fable 5 Non 10 $ / 50 $

Deux dollars en entrée, six en sortie par million de tokens pour Qwen3.8-Max. Le modèle de tête de Claude, c'est dix et cinquante. Ce n'est pas une remise, c'est un autre ordre de grandeur. Quand l'écart de qualité est d'un point ou deux et l'écart de prix de huit contre un, les gens se mettent à faire les comptes en silence.

Mon indice préféré : quelques jours avant la sortie de Qwen3.8, OpenAI a baissé un de ses modèles de 80 % du jour au lendemain, trois semaines après l'avoir lancé. Personne ne fait ça par bonté d'âme. On le fait parce que les modèles ouverts et pas chers venus de Chine ne laissent plus de marge.

Où ça vous laisse, concrètement

La frontière, ce n'est plus deux labos américains qui rationnent l'intelligence. C'est une vraie course, et une bonne partie du peloton est désormais ouverte, téléchargeable et chinoise. C'est cette pression qui maintient des prix raisonnables, que vous payiez pour Claude, pour GPT, ou que vous fassiez tourner un truc sur votre propre machine. Tout le monde profite de la concurrence.

Les réserves honnêtes, parce qu'il y en a toujours. Les poids n'étaient pas réellement téléchargeables le jour où j'écris ça (Alibaba dit la semaine prochaine), et « juste derrière Fable 5 » est la formule d'Alibaba, pas un résultat indépendant. Ne démontez pas votre stack pour un communiqué de presse. Mais la tendance n'a rien de discret.

Moins cher, plus ouvert, plus difficile à ignorer. Je prends.


Chiffres tirés des supports de lancement de Qwen3.8 chez Alibaba, de la couverture de Fortune et MarkTechPost, des classements Artificial Analysis et LMArena, de l'annonce de baisse de prix d'OpenAI du 30 juillet, et des pages tarifaires publiques des API. Tout ceci est un instantané au 3 août 2026 et, comme tout benchmark qui se respecte, à prendre avec de grosses pincettes. Les poids ouverts sont promis « pour la semaine prochaine » mais n'étaient pas encore sortis au moment où j'ai publié, donc vérifiez qwen.ai avant de me citer.