Qwen lanceert Qwen3.8 Max Prime

24-09-2026

Het Qwen-team van Alibaba bracht Qwen3.8 Max Prime uit op 23 september 2026 als nieuw premium model naast Qwen3.8 Max.

Geschreven door:

Senne Doets

Online Marketeer at DataNorth | Next-Gen AI & Tech Apprentice

Meld je aan voor de Nieuwsbrief

Published: 24 september 2026

Het Qwen-team van Alibaba bracht Qwen3.8 Max Prime uit op 23 september 2026, verkocht als een variant van Qwen3.8 Max met meer doorvoer, voor $4 per miljoen inputtokens en $12 per miljoen outputtokens. Dat is precies het dubbele van het standaardmodel. Op de enige openbare metingen die er zijn, is het niet meetbaar sneller.

Wat is Qwen3.8 Max Prime?

Het is hetzelfde model op andere capaciteit, aangeboden als een apart product. Qwen3.8 Max Prime neemt tekst, beeld en video als input en geeft tekst terug. Redeneren staat standaard aan en je kunt instellen hoeveel moeite het doet. Tool calling en gestructureerde output werken zoals bij het standaardmodel.

Het contextvenster is 1 miljoen tokens met maximaal 131.072 tokens output, onveranderd ten opzichte van Qwen3.8 Max. Alibaba Cloud International is de enige aanbieder. Er is geen aankondiging, en de documentatie van Alibaba Cloud Model Studio noemt nog altijd alleen qwen3.8-max en de momentopname van 2 september.

Qwen3.8 Max Prime tegenover Qwen3.8 Max

Dit haal je uit de tabel: de prijs verdubbelt, en de twee snelheidscijfers bewegen niet de kant op die dat zou rechtvaardigen.

Wat wordt gemetenQwen3.8 Max PrimeQwen3.8 Max
Input, per miljoen tokens$4,00$2,00
Output, per miljoen tokens$12,00$6,00
Cache lezen, per miljoen tokens$0,50$0,25
Gemeten snelheid40 tokens per seconde37 tokens per seconde
Gemeten reactietijd2,03 seconden1,42 seconden
Contextvenster1.000.000 tokens1.000.000 tokens

Al deze cijfers komen van OpenRouter, de enige plek waar Qwen3.8 Max Prime überhaupt is gedocumenteerd. De snelheid en de reactietijd zijn eigen metingen van OpenRouter op live verkeer, kort na de lancering, en een nieuw endpoint kan traag zijn zolang de capaciteit nog inregelt. Zie het als een eerste aflezing en niet als een eindoordeel. Qwen publiceerde zelf geen enkele claim over doorvoer om ze tegen af te zetten.

Wat Qwen niet vertelt

Eigenlijk alles. Geen blogpost, geen modelkaart, geen documentatie en geen benchmark. Een model dat Prime heet en het dubbele kost, moet ergens beter in zijn, en de leverancier zegt niet waarin. Op basis van wat er ligt, is het hetzelfde model met een grotere reservering op een gedeelde machine.

Dat kan best het eerlijke antwoord zijn, en voor sommige afnemers is dat een echt product. Gegarandeerde capaciteit is geld waard als je verkeer piekt en je het je niet kunt veroorloven achteraan in de rij te staan. Maar dat is een serviceafspraak, en die heeft Qwen niet gemaakt. Er is geen gepubliceerde limiet, geen beschikbaarheidsdoel en geen uitleg van wat je krijgt voor die extra $2 en $6.

Wat dit betekent

Te negeren, tenzij je nu al tegen limieten aanloopt op Qwen3.8 Max. Dit is het duidelijkste voorbeeld van het patroon dat meerdere labs deze maand oppakken: neem een werkend model, zet het op meer capaciteit, vraag een toeslag en publiceer niets. Z.ai deed diezelfde dag hetzelfde met GLM 5.3 Prime, en dat bedrijf zette er tenminste nog een snelheidsclaim onder.

Loop je wel tegen capaciteitsproblemen aan op Qwen3.8 Max, draai dan een week eigen verkeer door beide en vergelijk de staart. De mediane snelheid is niet de reden om dit te kopen, de traagste vijf procent van de verzoeken misschien wel. Dat is het getal dat je wilt meten, en precies dat heeft niemand gepubliceerd. Zolang Qwen niet documenteert wat Prime garandeert, is het dubbele betalen voor drie tokens per seconde extra geen besluit dat je aan een financieel manager uitlegt.

Voor meer informatie, bekijk de modelpagina van Qwen3.8 Max Prime op OpenRouter.

Maak DataNorth AI je Google favoriet