Shanghai beantwoordde de vraag die het in juli oversloeg

Op 3 augustus lanceerde Alibaba Qwen3.8-Max, het model dat op 19 juli op de World AI Conference in Shanghai werd getoond zonder de cijfers die ertoe deden. De specificatie is nu openbaar: 2,4 biljoen parameters in totaal, waarvan 95 miljard actief tijdens inferentie, gebouwd op de Qwen 3.5-architectuur en in staat tekst, beeld, video en documenten in één systeem te verwerken. Het in Hongkong genoteerde aandeel steeg in de vroege handel met ongeveer 6 procent tot 124,00 Hongkongse dollar.

Het bedrijf legde zich ook vast op het punt dat het in juli niet wilde dateren. De gewichten worden volgende week open gepubliceerd, waarmee dit het eerste Max-model van Qwen zou zijn dat iedereen kan downloaden en op eigen hardware draaien. Voor een Europese onderneming die Chinese topmodellen juist volgt omdat open gewichten zelf hosten, inspectie en vertrek mogelijk maken, is dat het deel van de aankondiging met gevolgen.

De 95 miljard actieve parameters zijn het echte goede nieuws

Waarom het telt: de activeringsgraad is wat een parameteraantal in een rekening verandert. Qwen3.8-Max zet per vraag ongeveer 4 procent van zijn netwerk in, dus de rekenkracht per verzoek lijkt meer op een model van 95 miljard parameters dan op een van 2,4 biljoen. Alibaba plaatst de inferentiekosten onder die van de vorige generatie, en de bekendgemaakte architectuur onderbouwt die claim ditmaal in plaats van hem te vertroebelen.

Het is precies het cijfer dat in de juli-preview ontbrak, en het valt gunstig uit. Wie tokens inkoopt via een interface, moet hieruit lezen dat een model dat met 2,4 biljoen parameters wordt verkocht niet als zodanig geprijsd hoort te worden. De proefversie loopt nog op 10 procent van het standaardtarief via Token Plan, Qoder en QoderWork, en de voorganger Qwen3.7-Max staat genoteerd op 2,50 dollar per miljoen invoertokens en 7,50 per miljoen uitvoertokens, ongeveer 2,30 en 6,90 euro. Beoordeel elk aanbod tegen die lijst, nooit tegen de actieprijs.

Tel daarna het geheugen, niet de parameters

Het getal dat niemand in een kop zette: 2,4 biljoen parameters vasthouden vergt bij 8-bits precisie ongeveer 2,4 terabyte geheugen, en rond 1,2 terabyte als u naar 4 bits kwantiseert en het kwaliteitsverlies accepteert. Een server met acht H200-grafische processoren levert in totaal ongeveer 1,1 terabyte snel geheugen. Open gewichten van deze omvang betekenen dus geen enkele server. Ze betekenen minstens twee volledige nodes bij 8 bits, of een krappe pasvorm op één node na agressieve kwantisatie, nog voordat u één byte hebt toegewezen aan de sleutelwaardecache die de gelijktijdige gebruikers werkelijk bedient.

Dat valt in de slechtst denkbare maand. Geheugen is nu de schaarste grondstof van de sector: ongeveer 70 procent van het aanbod voor volgend jaar is al vastgelegd, de contractprijzen voor DRAM en HBM stegen het hele kwartaal, en de krapte reikt zo diep dat Apple een instapmodel laptop niet op voorraad kan houden en kopers naar een duurder toestel stuurt. De vrijheid die open gewichten geven is echt, en voor de meeste Europese ondernemingen is zij op dit moment theoretisch. U krijgt de sleutels van een gebouw waarvan u de vloeroppervlakte niet kunt huren.

De benchmarkclaim blijft Alibaba dat Alibaba meet

Alibaba stelt dat het model in grote lijnen concurreert met de belangrijkste Amerikaanse systemen, dat het ze verslaat op meerdere tests voor programmeren, multimodaliteit en engineering, en dat het achterblijft op enkele algemene redeneerproeven, en het plaatst zichzelf opnieuw net achter de Fable 5 van Anthropic. Elk van die posities komt uit Alibaba's eigen lanceringsmateriaal. Geen enkele onafhankelijke ranglijst heeft Qwen3.8-Max tot nu toe beoordeeld, net zomin als bij de juli-preview.

Ja, maar: het openstellen van de gewichten verandert het gewicht van dat voorbehoud in plaats van het weg te nemen. Zodra gewichten openbaar zijn, hangt onafhankelijke evaluatie niet langer af van de welwillendheid van de leverancier of van interfacetoegang, en wordt een positieclaim binnen dagen weerlegbaar door iedereen met de machine om hem te laden. Een leverancier die zijn gewichten een week na een positieclaim openstelt, is op zijn minst bereid gecontroleerd te worden. De juiste reactie is die controle afwachten, nu dagen weg in plaats van onbepaald.

Wat dit deze maand verandert voor een Europese koper

In uw productieomgeving voorlopig niets. De te volgen volgorde is smal: laat de gewichten landen, laat de onafhankelijke scores binnenkomen, en test dan op uw eigen werklast tegen het volle lijsttarief in plaats van het proeftarief. Dat is een beslissing voor september en niet voor augustus, en er staat geen boete op tweede zijn bij een model dat over zes weken nog bestaat.

De kern: de strategische vraag van deze lancering is niet of een Chinees model goed genoeg is. Het is of open gewichten nog onafhankelijkheid kopen wanneer de hardware om die uit te oefenen gerantsoeneerd is. Als zelf hosten überhaupt uw reden is om deze releases te volgen, is de bindende beperking stilletjes verschoven van licentievoorwaarden naar geheugeninkoop, en daar hoort de planning nu thuis.