📰 ChatGPT vervangt modelnamen door een simpele schuifregelaar📰 Rechtszaak tegen Anthropic: leverde Claude Max wel de beloofde capaciteit?📰 MCP wordt stateless: het protocol achter agentic AI krijgt een grote architectuurmakeover📰 Fable 5: Anthropics nieuwe vlaggenschipmodel verslaat Opus 4.8📰 Claude Sonnet 5 wordt het nieuwe standaardmodel voor gratis gebruikers📰 GPT-5.6 in preview: OpenAI splitst modellen in Sol, Terra en Luna📰 Claude Sonnet 5 wordt de nieuwe standaard, en Claude Desktop landt eindelijk op Linux📰 Claude Code-automatisering krijgt eigen dollarfacturering los van je abonnement📰 ChatGPT vervangt modelnamen door een simpele schuifregelaar📰 Rechtszaak tegen Anthropic: leverde Claude Max wel de beloofde capaciteit?📰 MCP wordt stateless: het protocol achter agentic AI krijgt een grote architectuurmakeover📰 Fable 5: Anthropics nieuwe vlaggenschipmodel verslaat Opus 4.8📰 Claude Sonnet 5 wordt het nieuwe standaardmodel voor gratis gebruikers📰 GPT-5.6 in preview: OpenAI splitst modellen in Sol, Terra en Luna📰 Claude Sonnet 5 wordt de nieuwe standaard, en Claude Desktop landt eindelijk op Linux📰 Claude Code-automatisering krijgt eigen dollarfacturering los van je abonnement

Alibaba heeft op 3 augustus 2026 Qwen3.8-Max officieel gelanceerd, nadat het model twee weken eerder al werd getoond tijdens de World AI Conference in Shanghai. Met 2,4 biljoen parameters is het na Moonshot’s Kimi K3 het op één na grootste publiek bekende taalmodel ter wereld, en het is meteen ook multimodaal: tekst, beelden en (deels) video worden in één netwerk verwerkt.

Wat het model interessant maakt is niet alleen de omvang, maar de manier waarop die omvang wordt ingezet. Van de 2,4 biljoen parameters worden er per token slechts ongeveer 95 miljard geactiveerd, zo’n 4 procent van het totaal. Dat is de kern van de mixture-of-experts-architectuur die Qwen al sinds versie 3 gebruikt: een groot aantal gespecialiseerde subnetwerken waarvan er per aanvraag maar een klein deel wordt geraadpleegd. Het resultaat is een model dat op benchmarks dicht bij de frontier-modellen van OpenAI en Anthropic komt, terwijl de rekenkosten per token beperkt blijven.

Waarom dit relevant is voor developers

Voor wie zelf software bouwt op AI-modellen is vooral de prijsstelling opvallend. Alibaba vraagt via de API 2 dollar per miljoen inputtokens en 6 dollar per miljoen outputtokens, tegenover 3 en 15 dollar bij Kimi K3. Dat maakt Qwen3.8-Max ruwweg twee en een half keer goedkoper op output, een verschil dat bij productieworkloads met veel gegenereerde tokens flink oploopt.

Nog belangrijker voor de lokale modellen-gemeenschap: naast de gesloten Max-versie heeft Alibaba ook Qwen3.8-27B vrijgegeven onder de Apache 2.0-licentie op Hugging Face. Dat is een dichte variant die prima op een enkele stevige GPU of een Mac met voldoende unified memory draait. Er is ook een 2,4T-checkpoint met een aangepaste licentie beschikbaar voor wie echt de volledige Max-klasse lokaal wil proberen te hosten, al mist die versie de vision-mogelijkheden en de native contextlengte van 1 miljoen tokens die de API-versie wel heeft.

Concurrentie houdt de prijzen laag

De timing is geen toeval. Qwen3.8-Max verscheen slechts enkele dagen na de open-weight release van Kimi K3 door Moonshot AI, en beide bedrijven lijken elkaar continu te willen overtreffen op zowel prestaties als prijs. Voor Nederlandse ontwikkelaars die via ollama pull of vergelijkbare tooling lokaal experimenteren, betekent deze concurrentiestrijd dat er steeds vaker sterke, betaalbare of zelfs gratis te downloaden modellen beschikbaar komen die voorheen alleen als dure cloud-API bestonden.

De praktische afweging blijft hetzelfde als altijd: de Max-API is sneller inzetbaar en heeft de volledige multimodale mogelijkheden, maar wie privacy, kosten op de lange termijn of offline gebruik belangrijk vindt, kan met de 27B-variant al een groot deel van de coderingscapaciteit lokaal benutten. Verwacht de komende maanden meer afgeleide, gequantiseerde GGUF-builds van deze 27B-versie verschijnen voor gebruik met Ollama en llama.cpp.

Bron: https://www.marktechpost.com/2026/07/19/alibaba-previews-qwen3-8-max-a-2-4-trillion-parameter-multimodal-model-days-after-moonshots-kimi-k3-open-weight-launch/

Categorieën: NIEUWS

0 reacties

Geef een reactie

Avatar plaatshouder

Je e-mailadres wordt niet gepubliceerd. Vereiste velden zijn gemarkeerd met *