Hvad Alibaba annoncerede i Shanghai

Den 19. juli viste Alibabas Qwen-hold på World AI Conference i Shanghai en forhåndsversion af Qwen3.8-Max, det næste flagskib i Qwen-familien. Overskriften lyder 2,4 billioner parametre, og det er holdets første multimodale model over en billion, som håndterer tekst, billeder, video og dokumenter i ét system.

Alibaba placerer den kun efter Claude Fable 5 og siger, at den forbedrer Qwen3.7-Max inden for programmering, full-stack-udvikling, dataanalyse og kontorarbejdsgange. En forhåndsversion er tilgængelig gennem Alibabas Token Plan, Qoder og QoderWork til 10 procent af standardprisen, og selskabet har lovet åbne vægte snart uden at nævne en dato.

Det manglende tal fastsætter prisen på jeres arbejdsbyrde

Hvorfor det betyder noget: 2,4 billioner er tallet, der bliver gengivet, og tallet, der fortæller jer mindst. Store frontmodeller af denne bygning er tynde mixture-of-experts-systemer, hvor kun en del af parametrene er i brug ved hver forespørgsel. Totalen beskriver, hvor meget model der findes. Det aktive antal beskriver, hvor meget af den der kører, og dermed hvor meget regnekraft hver forespørgsel bruger.

Det tal har Alibaba ikke oplyst. Den ene udeladelse gør den annoncerede størrelse ubrugelig til planlægning: en model med 2,4 billioner parametre og en lille aktiv andel kan være billigere at drive end en langt mindre tæt model, og en med en stor aktiv andel langt dyrere. Den, der udleder et budget af overskriftstallet, regner med et tal, der er valgt for at imponere og ikke for at oplyse.

En placeringspåstand uden noget bag sig endnu

Påstanden om andenpladsen fortjener samme skepsis. Alibaba nævner en konkret konkurrent, Claude Fable 5, og placerer sig direkte under den uden at offentliggøre benchmarkresultater, der understøtter placeringen.

Det er det omvendte af det mønster, der er værd at stole på. Da Moonshot udgav Kimi K3, gav selskabets egen meddelelse modellen andenpladsen samlet set, og uafhængige test på Arena.ai satte den derefter på førstepladsen for frontendkode. En leverandør, hvis egen påstand er mere beskeden end det uafhængige resultat, har givet jer et brugbart signal. En leverandør, hvis påstand ankommer uden noget uafhængigt resultat, har givet jer en presselinje. Indtil de offentlige ranglister bedømmer Qwen3.8-Max, er placeringen Alibabas mening om Alibaba.

Læs rabatten som det, den er

Kort sagt: en forhåndsversion til 10 procent af listeprisen er en invitation til at teste, ikke et tilbud om at bygge på. Prisen udfører et stykke arbejde, nemlig at få rigtige arbejdsbyrder over på en ubevist model hurtigt nok til at frembringe det evalueringsbelæg, lanceringen ikke indeholdt.

Der er intet forkert i det, og for et europæisk hold med ledig evalueringskapacitet kan det være en billig måde at lære noget på. Fejlen er at tage rabatprisen for modellens økonomi. Forhåndspriser ophører, standardprisen ligger ti gange højere, og enhver forretningssag bygget på kampagnetallet vender i det øjeblik, forhåndsversionen lukker. Hvis I tester den, så test den på jeres egen arbejdsbyrde og noter, hvad den koster til fuld listepris, ikke til introduktionsprisen.

Snart er ikke en dato, og sammenligningen har en

Løftet om åbne vægte har den klareste følge for alle, der overvejer uafhængighed af et hostet API. Alibaba siger, at vægtene kommer snart, og binder sig ikke. Moonshot har sagt, at Kimi K3's fulde vægte ankommer den 27. juli.

For en operatør, der lægger vægt på at kunne køre en model på infrastruktur, han selv kontrollerer, er de to udsagn ikke sammenlignelige. Det ene er en plan med en dato, I kan sætte i kalenderen og holde en leverandør op på. Det andet er en hensigt. Hvis jeres grund til overhovedet at følge kinesiske frontmodeller er, at åbne vægte lader jer hoste selv, efterse og gå, så bringer en udgivelse uden dato endnu ikke det mål nærmere, uanset hvor stort det tilknyttede parametertal er.