3 augustus 2026 · 3 min leestijd

Qwen3.8 is open-weight, en één versie past op je laptop

Twee weken geleden schreef ik over Kimi K3, het eerste echt hoogwaardige model dat je kon downloaden en op een schijf bewaren. Ik dacht dat dat wel even bovenaan zou blijven. Niet dus. Alibaba bracht net Qwen3.8 uit, en doet het ene wat ze bij hun laatste twee vlaggenschepen weigerden: ze geven de weights weg.

Daar mag je even bij stilstaan. Alibaba zegt dat Qwen3.8-Max, hun nieuwe topmodel, Kimi K3 net voorbijstreeft op de benchmarks die ertoe doen, en ze zetten het open in plaats van het achter een API te vergrendelen. Een bedrijf dat zijn beste modellen angstvallig bewaakte, begint ze uit te delen.

Waarom dat telt, zonder de benchmarksoep.

Er zijn twee modellen, en ze tellen allebei

Qwen3.8-Max is de kolos. 2,4 biljoen parameters, maar gebouwd als mixture-of-experts, dus maar een klein deel vuurt echt af per verzoek, precies de truc die iets van dit formaat betaalbaar houdt om te serveren. Het verwerkt tekst, beeld en video, houdt een romanlengte aan context vast, en het mikt op het lange, rommelige werk: een hele codebase schrijven, dagenlang aan een onderzoekstaak draaien. Het hoort thuis in hetzelfde gesprek als de modellen waar je een vermogen voor betaalt.

Qwen3.8-27B is degene die mij eerlijk gezegd meer boeit. Open weights betekenen pas iets als je het ding echt kunt draaien, en dit is de versie die past op hardware die gewone mensen bezitten. Als hij zijn voorganger volgt, heeft Unsloth hem binnen dagen gequantized tot een enkele gaming-GPU of een fatsoenlijke Mac. Geen cloud, geen abonnement, geen data die je aan iemand afstaat. Bijna-topklasse op je eigen bureau. Twaalf maanden geleden was dat sciencefiction.

Het stuk waar je boekhouder wakker van ligt

De top van de ranglijst is in de ruis verdwenen. Op echte taken zitten Qwen3.8-Max, Kimi K3 en de betaalde vlaggenschepen van Anthropic en OpenAI zo dicht bij elkaar dat "welke is het slimst" niet langer de interessante vraag is. "Welke leegt mijn rekening niet" nam het over.

En op díé vraag is het verschil enorm.

Model Open weights? API-prijs (in / out per M)
Qwen3.8-Max Ja (volgende week) $2 / $6
Kimi K3 Ja $3 / $15
GPT-5.6 Sol Nee $5 / $30
Claude Fable 5 Nee $10 / $50

Twee dollar in, zes uit per miljoen tokens voor Qwen3.8-Max. Het topmodel van Claude staat op tien en vijftig. Dat is geen korting, dat is een andere orde van grootte. Als het kwaliteitsverschil een punt of twee is en het prijsverschil acht-op-een, gaan mensen stilletjes rekenen.

Mijn favoriete signaal: dagen voor Qwen3.8 uitkwam, verlaagde OpenAI een van zijn modellen met 80% van de ene op de andere dag, drie weken na de lancering. Niemand doet dat uit goedhartigheid. Je doet het omdat goedkope open modellen uit China je geen ruimte laten.

Waar dit je uiteindelijk brengt

De frontier is niet langer twee Amerikaanse labs die intelligentie rantsoeneren. Het is een echte race, en een flink deel van het peloton is nu open, downloadbaar en Chinees. Die druk houdt de prijzen redelijk, of je nu voor Claude betaalt, voor GPT, of iets op je eigen machine draait. Iedereen profiteert van de concurrentie.

De eerlijke kanttekeningen, want die zijn er altijd. De weights waren op de dag dat ik dit schrijf nog niet echt te downloaden (Alibaba zegt volgende week), en "net onder Fable 5" is Alibaba's eigen formulering, geen onafhankelijk resultaat. Ruk je stack niet uit voor een persbericht. Maar de trendlijn is allesbehalve subtiel.

Goedkoper, opener, moeilijker te negeren. Doe mij maar.


Cijfers komen van Alibaba's Qwen3.8-lanceringsmateriaal, de launchdekking van Fortune en MarkTechPost, de benchmarkborden van Artificial Analysis en LMArena, OpenAI's prijsverlaging van 30 juli, en de publieke API-prijspagina's. Dit alles is een momentopname van 3 augustus 2026 en moet, zoals elke benchmark ooit, met een flinke korrel zout worden genomen. De open weights zijn beloofd voor "volgende week" maar waren nog niet uit toen ik op publiceren drukte, dus check qwen.ai voor je mij gaat citeren.