{"id":3443046,"date":"2026-08-27T11:15:12","date_gmt":"2026-08-27T09:15:12","guid":{"rendered":"https:\/\/datanorth.ai\/?post_type=news&#038;p=3443046"},"modified":"2026-08-27T11:15:00","modified_gmt":"2026-08-27T09:15:00","slug":"alibaba-lanceert-qwen3-8-flash-next","status":"publish","type":"news","link":"https:\/\/datanorth.ai\/nl\/nieuws\/alibaba-lanceert-qwen3-8-flash-next","title":{"rendered":"Alibaba lanceert Qwen3.8-Flash-Next"},"content":{"rendered":"\n<p class=\"wp-block-paragraph\"><em>Publicatiedatum: 27 augustus 2026<\/em><\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Alibaba&#8217;s Qwen-team heeft <strong>Qwen3.8-Flash-Next<\/strong> uitgebracht, een open-weight multimodaal model dat vooruitblikt op de architectuur van Qwen4. Per token zijn slechts 6 miljard parameters van het hoofdmodel actief, terwijl het model standaard <strong>262.144 tokens context<\/strong> ondersteunt.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">De interessantste vernieuwing zit niet in een nieuwe benchmarkscore. Alibaba experimenteert met een architectuur die grote modellen goedkoper moet maken bij lange context vensters, coding agents en omvangrijke document taken.<\/p>\n\n\n\n<h2 class=\"wp-block-heading\">Wat is Qwen3.8-Flash-Next?<\/h2>\n\n\n\n<p class=\"wp-block-paragraph\">Qwen3.8-Flash-Next gebruikt een <strong>mixture-of-experts-architectuur<\/strong>. Daarbij wordt voor iedere token slechts een deel van het model ingeschakeld. Het hoofdmodel telt 125 miljard parameters en gebruikt daarnaast 51 miljard parameters voor N-gram embeddings.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Alibaba presenteert het model expliciet als een vroege blik op technologie die richting Qwen4 gaat. Een belangrijk onderdeel is Qwen Sparse Attention. Die techniek probeert eerst de relevante delen uit een lange context te selecteren voordat zwaardere aandachtberekeningen plaatsvinden.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Het model ondersteunt standaard 262.144 tokens. Met YaRN kan dat volgens Alibaba worden uitgebreid tot \u00e9\u00e9n miljoen tokens. De productievariant Qwen3.8-Flash is juist rond dat grotere contextvenster opgebouwd.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Voor teams die grote codebases of lange agentgeschiedenissen verwerken, kan dit direct interessant zijn. De belangrijkste onzekerheid is nog hoeveel van de beloofde effici\u00ebntie overeind blijft buiten Alibaba&#8217;s eigen tests.<\/p>\n\n\n\n<h2 class=\"wp-block-heading\">Qwen3.8-Flash-Next benchmarks, toegang en prijs<\/h2>\n\n\n\n<p class=\"wp-block-paragraph\">Alibaba publiceert sterke resultaten voor softwareontwikkeling en agenttaken. Het gaat om cijfers van Alibaba zelf en niet om onafhankelijke evaluaties.<\/p>\n\n\n\n<figure class=\"wp-block-table\"><table><thead><tr><th>Wat wordt gemeten<\/th><th>Qwen3.8-Flash-Next<\/th><th>Vergelijking<\/th><\/tr><\/thead><tbody><tr><td>DeepSWE 1.1, coding agents<\/td><td>58,7<\/td><td>DeepSeek-V4-Flash-0731: 54,4<\/td><\/tr><tr><td>SWE-bench Pro, softwareontwikkeling<\/td><td>62,5<\/td><td>Claude Opus 4.6 Max: 53,4<\/td><\/tr><tr><td>CoWorkBench, lange kantoortaken<\/td><td>73,9<\/td><td>Claude Opus 4.6 Max: 68,2<\/td><\/tr><tr><td>Toolathlon Verified, toolgebruik<\/td><td>73,5<\/td><td>DeepSeek-V4-Flash-0731: 70,3<\/td><\/tr><tr><td>AndroidWorld, mobiele agents<\/td><td>84,5<\/td><td>Qwen3.8-27B: 81,9<\/td><\/tr><\/tbody><\/table><\/figure>\n\n\n\n<p class=\"wp-block-paragraph\">De gewichten zijn beschikbaar via Hugging Face en ModelScope. Op Hugging Face neemt de repository ongeveer 360 GB in beslag.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Belangrijk is dat Alibaba deze versie niet onder Apache 2.0 uitbrengt. <strong>Qwen Community License 1.0<\/strong> staat veel vormen van gebruik en aanpassing toe, maar bevat extra voorwaarden voor bepaalde grote producten, modeldiensten en AI-assistenten voor kantoorwerk of programmeren.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Dat maakt de licentie relevant voor bedrijven die het model commercieel willen hosten. Vooral aanbieders van coding assistants of generieke werkassistenten moeten de voorwaarden vooraf controleren.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">De productievariant Qwen3.8-Flash wordt aangekondigd voor <strong>$0,16 per miljoen inputtokens<\/strong> en <strong>$0,47 per miljoen outputtokens<\/strong>. Bij publicatie meldde Alibaba echter dat de API nog niet actief was. De open weights zijn wel beschikbaar.<\/p>\n\n\n\n<h2 class=\"wp-block-heading\">Hoe vergelijkt Qwen3.8-Flash-Next met eerdere Qwen-modellen?<\/h2>\n\n\n\n<p class=\"wp-block-paragraph\">Alibaba vergelijkt de nieuwe architectuur vooral met Qwen3.7-Plus. Qwen3.8-Flash-Next zou ongeveer een negende van de trainingskosten vragen en tegelijkertijd beter scoren op verschillende programmeer- en kantoortaken.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Dat maakt het model vooral interessant als effici\u00ebntie-experiment. Het is geen klein model dat toevallig goed scoort. De volledige set gewichten blijft groot, ook al zijn er per token weinig parameters actief.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Een belangrijk ontbrekend stuk is onafhankelijke praktijktesting. Alibaba levert veel eigen benchmarkdata, maar er is nog weinig onafhankelijke informatie over doorvoer, geheugenverbruik en langere agenttaken in productie.<\/p>\n\n\n\n<h2 class=\"wp-block-heading\">Wat dit betekent<\/h2>\n\n\n\n<p class=\"wp-block-paragraph\"><strong>Nu het testen waard.<\/strong> Een klein technisch team dat coding agents of documentagents op eigen infrastructuur draait, heeft voldoende reden om Qwen3.8-Flash-Next te evalueren. De combinatie van open weights, sterke codingresultaten en slechts 6 miljard actieve parameters is opvallend.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Meet vooral het geheugenverbruik, de snelheid en het percentage volledig afgeronde taken in je eigen workflow. Controleer daarnaast de nieuwe Qwen-licentie voordat het model onderdeel wordt van een commerci\u00eble AI-assistent.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\"><em>Voor meer informatie, bekijk <a href=\"https:\/\/qwen.ai\/blog?id=qwen3.8-flash-next&amp;utm_source=chatgpt.com\" target=\"_blank\" rel=\"noopener noreferrer nofollow\">de offici\u00eble aankondiging van Qwen3.8-Flash-Next op de website van Alibaba Qwen<\/a>.<\/em><\/p>\n","protected":false},"excerpt":{"rendered":"<p>Alibaba bracht Qwen3.8-Flash-Next op 26 augustus 2026 uit. Het open-weight multimodale model geeft een vroege blik op Qwen4 en activeert slechts 6 miljard hoofdmodel parameters per token. Standaard ondersteunt het model 262.144 tokens context, met uitbreiding tot \u00e9\u00e9n miljoen tokens.<\/p>\n","protected":false},"author":12,"featured_media":3443044,"template":"","tags":[],"news-category":[],"class_list":["post-3443046","news","type-news","status-publish","has-post-thumbnail"],"meta_box":[],"_links":{"self":[{"href":"https:\/\/datanorth.ai\/nl\/wp-json\/wp\/v2\/news\/3443046","targetHints":{"allow":["GET"]}}],"collection":[{"href":"https:\/\/datanorth.ai\/nl\/wp-json\/wp\/v2\/news"}],"about":[{"href":"https:\/\/datanorth.ai\/nl\/wp-json\/wp\/v2\/types\/news"}],"author":[{"embeddable":true,"href":"https:\/\/datanorth.ai\/nl\/wp-json\/wp\/v2\/users\/12"}],"wp:featuredmedia":[{"embeddable":true,"href":"https:\/\/datanorth.ai\/nl\/wp-json\/wp\/v2\/media\/3443044"}],"wp:attachment":[{"href":"https:\/\/datanorth.ai\/nl\/wp-json\/wp\/v2\/media?parent=3443046"}],"wp:term":[{"taxonomy":"post_tag","embeddable":true,"href":"https:\/\/datanorth.ai\/nl\/wp-json\/wp\/v2\/tags?post=3443046"},{"taxonomy":"news-category","embeddable":true,"href":"https:\/\/datanorth.ai\/nl\/wp-json\/wp\/v2\/news-category?post=3443046"}],"curies":[{"name":"wp","href":"https:\/\/api.w.org\/{rel}","templated":true}]}}