De to linjer i prislisten
xAIs offentlige prisside viser i øjeblikket begge versioner af tale-til-tale-modellen ved siden af hinanden, og det er den klareste måde at se, hvad der er på vej. Grok Voice Think Fast 1.0 står til 0,05 dollar pr. minut lyd, altså 3,00 dollar i timen, plus 0,004 dollar for tekstinput. Grok Voice Think Fast 2.0 står til 0,08 dollar i minuttet, altså 4,80 dollar i timen, med samme tekstpost. Samme produktkategori, samme leverandør, samme side, 60 procents forskel mellem to linjer.
Datoen findes i udgivelsesnoten fra den 29. juli. xAI fastholder der, at grok-voice-think-fast-2.0 nu er tilgængelig med Speech to Speech, og at grok-voice-latest vil pege på denne model fra den 5. august 2026. Virksomhedens egen migrationsvejledning siger, at der ikke kræves nogen handling for at opgradere, og at den, der ønsker at blive på den ældre model, skal låse grok-voice-think-fast-1.0 inden da. Læs de to sætninger sammen, og ugens form står klart: den billigere mulighed findes stadig, og det er ikke den, man får ved at lade sin kode være.
Hvad opgraderingen faktisk forbedrer
Intet af dette handler om at tage mere for mindre. I Artificial Analysis' uafhængige tale-til-tale-test fik Think Fast 2.0 82,9 procent mod 75,7 procent for version 1.0. Tiden til første lyd, altså den pause en opkalder hører, før modellen begynder at tale, faldt fra 1,25 til 0,70 sekunder. Det relative medianforbrug af ræsonnementstokens faldt til 0,4 gange forgængerens, fordi den nye model ræsonnerer sideløbende med talen i stedet for at tænke først og tale bagefter. Også transskriptionsnøjagtigheden blev bedre. Efter enhver offentliggjort målestok er dette en bedre model, som koster sin producent mindre at drive.
Netop den sidste sætning er den interessante. En model, der brænder 60 procent færre ræsonnementstokens og svarer på omtrent den halve tid, er billigere at levere, og på tekstmarkedet når den kendsgerning kunden inden for uger. Den nåede OpenAIs kunder den 30. juli, da selskabet skar GPT-5.6 Luna med 80 procent og Terra med 20 procent og henviste til et fald i egne driftsomkostninger. Her kom samme klasse af forbedring vedhæftet en stigning på 60 procent. Der er intet uredeligt ved det. Det er den enkle følge af den enhed, måleren tæller.
Hvorfor en bedre model koster mere her
Tekst og tale sælges på forskellige ure, og forskellen afgør, hvem der beholder effektiviteten. Tekst afregnes pr. token, som er et mål for udført arbejde. Når en model behøver færre tokens for at nå det samme svar, falder din regning, uden at nogen skal beslutte det, for du køber beregningsenheder og har nu brug for færre. Tale afregnes pr. minut lyd, som er et mål for forløben tid. En opkalder, der forklarer et leveringsproblem, bruger de samme halvfems sekunder, uanset om modellen bag linjen er hurtig eller langsom, så antallet af fakturerbare enheder sættes af menneskelig tale og ikke af modeleffektivitet.
Følgen er, at tale er den ene linje i et AI-budget, som strukturelt ikke kan få gavn af effektivitetskapløbet, og samtidig den linje, der skalerer med dine kunder frem for med din teknik. Enhver forbedring, din leverandør laver på et produkt pr. token, dukker før eller siden op som en mindre regning. Enhver forbedring på et produkt pr. minut dukker op som et bedre produkt til den pris, leverandøren fastsætter, og besparelsen bliver, hvor den blev skabt. En ejer, der ser modelpriser falde hele året, kan med rimelighed antage, at al AI bliver billigere. Det er måleren og ikke modellen, der afgør, om det passer for en given arbejdsbyrde.
Regnestykket på dit eget opkaldsvolumen
Læg rigtige tal ved siden af, for procenten undervurderer, hvor hurtigt det hober sig op. Et opkald på fire minutter koster 20 cent på version 1.0 og 32 på version 2.0. Ti tusind sådanne opkald om måneden er 40.000 minutter, altså 2.000 dollar mod 3.200 dollar, en forskel på 1.200 dollar om måneden eller 14.400 dollar om året, opstået af en rutningsændring og ikke af nogen beslutning, du har truffet. For en europæisk operatør er taksten noteret i dollar, mens omsætningen bag opkaldene er i euro eller pund, så stigningen lander på en omkostningslinje, der i forvejen er udsat for en valuta, du ikke fakturerer i.
Det er værd at efterprøve, om hastighedsgevinsten betaler noget af dette, og den er ikke i nærheden. Antag at den hurtigere start fjernede hele ti sekunder fra det fire minutter lange opkald, langt mere end forbedringen på 0,55 sekunder i tiden til første lyd med rimelighed kan levere. Ti sekunder er til den nye takst omkring 1,3 cent værd mod 12 cents ekstra omkostning på samme opkald. Den generøse udgave af argumentet henter cirka en niendedel af stigningen tilbage. At købe den bedre model kan forsvares på kvalitet og på opkalderens oplevelse. Det er ikke en besparelse, og enhver forretningscase, der fremstiller det sådan, har forvekslet en hurtigere model med en billigere.
Lås den, eller sæt den på budgettet
Inden onsdag findes der kun to hæderlige standpunkter, og begge kræver en handling i denne uge. Hvis din taleagent laver rutinepræget, manuskriptstyret arbejde, hvor 75,7 procent i testen allerede var nok, så lås grok-voice-think-fast-1.0 i din konfiguration og behold timetaksten på 3,00 dollar. Hvis opkaldere jævnligt støder mod den gamle models grænser, så tag 2.0 bevidst, genberegn talelinjen til 4,80 dollar pr. time lyd, og noter i budgettet, at stigningen købte latens og nøjagtighed, ikke besparelser. Det, der ikke kan forsvares bagefter, er at opdage ændringen på en septemberfaktura.
Den bredere vane, det er værd at opbygge, er at læse enheden før prisen. Spørg om hver AI-tjeneste i din stak, hvad måleren tæller, for netop den ene oplysning forudsiger, om leverandørens effektivitet nogensinde når frem til dig: regninger pr. token og pr. forespørgsel falder, efterhånden som modellerne bliver bedre, mens regninger pr. minut, pr. plads og pr. samtale ikke gør. Find derefter aliasserne. Enhver betegnelse, der ender på latest, er en stående instruks om at acceptere alt, hvad leverandøren udsender næste gang, prisen inklusive, og de eneste arbejdsbyrder, hvor den indstilling er den rigtige, er dem, hvor du på forhånd har besluttet, at prisen på næste version er dig ligegyldig.
Læs videre: Modellen skiftede, API-navnet gjorde ikke | OpenAIs mellemniveau koster nu ti gange det billigste



