Från fast pris till högtrafiktillägg hos DeepSeek

DeepSeeks egen API-ändringslogg visar förloppet tydligt: V4-Pro nådde allmän tillgänglighet omkring den 12-13 augusti 2026, och bara några dagar senare, den 16 augusti, introducerade DeepSeek en högtrafikprissättning som ersatte det tidigare fasta priset på 0,87 USD per miljon utdata-token med ett högtrafikpris på cirka 3,96 USD per miljon utdata-token, en ökning på ungefär 4,5 gånger under dygnets mest belastade timmar.

Unite.AI och Quartz bekräftade förändringen oberoende av varandra, vilket styrker jämförelsen mellan fast pris och högtrafikpris som uppdateringens centrala faktum. Det som är mindre säkert dokumenterat i samma rapportering är den exakta lågtrafikprissättningen som DeepSeek nu tar ut, så den här artikeln behandlar språnget från fast till högtrafikpris som det bekräftade faktumet och lämnar lågtrafiksiffran öppen i stället för att uppfinna en precision som inte finns.

Fyra siffror som berättar den verkliga historien

Sida vid sida sammanfattar fyra siffror förändringen bättre än någon berättelse: datumet för V4-Pros allmänna tillgänglighet, det fasta pris som gällde innan den 16 augusti, högtrafikpriset som gäller nu, och multiplikatorn mellan dem.

MilstolpeDatumDetalj
Allmän tillgänglighet för V4-Pro12-13.08.2026Enligt DeepSeeks egen API-ändringslogg
Tidigare fast pris (utdata-token)Till och med 15.08.20260,87 USD per miljon utdata-token
Nytt högtrafikpris (utdata-token)Från 16.08.2026Cirka 3,96 USD per miljon utdata-token
Prismultiplikator16.08.2026Ungefär 4,5 gånger i högtrafik

Läst som en tidslinje snarare än en tabell är mönstret att en helt ny flaggskeppsmodell lanserades, och att prisstrukturen under den inom loppet av några dagar ändrades på ett sätt som inte har något att göra med modellens förmåga och allt att göra med efterfrågan den timme ett företag råkar köra sin arbetsbelastning.

Billig AI var aldrig en fast kostnad, det var en ögonblicksbild

Alla som har hanterat en molnfaktura eller ett elavtal känner redan igen den här dynamiken: ett publicerat pris är en ögonblicksbild av dagens utbud och efterfrågan, inte ett löfte om imorgon, och prissättningen för inferens i en ny, populär modell följer exakt samma logik.

DeepSeek prissatte V4-Pro tillräckligt lågt vid lanseringen för att dra bort kostnadskänsliga arbetsbelastningar från västliga toppleverantörer, och det låga priset var verkligt, men det var aldrig kontraktsmässigt fastlåst på samma sätt som ett långsiktigt företagsavtal kan vara, det var en prissättning som leverantören kunde ändra i det ögonblick den egna infrastrukturen slog i ett efterfrågetak, precis som hände några dagar efter den allmänna tillgängligheten.

Lock-in-risken som EU- och UK-köpare inte prissatte

Många europeiska och brittiska företag flyttade arbetsbelastningar till DeepSeek just därför att det var betydligt billigare än västliga topmodeller, ett enkelt kostnadsbeslut som Servola tidigare har täckt tillsammans med DeepSeeks separata EU-efterlevnadslucka i dess tidigare V4-visionsmodell, och det är precis den kostnadsdrivna logiken som denna prisändring nu sätter på prov.

En operatör som bytte enbart på grund av priset, utan att bygga in flexibiliteten att byta leverantör eller flytta arbetsbelastningen bort från högtrafiktimmarna, står nu kvar med samma lock-in-risk som de trodde de undvek genom att lämna en västlig leverantör, nu med mindre avtalsmässig och juridisk upprättelse, och med den underliggande exponeringen för datasuveränitet vid användning av en kinesisk leverantör fortfarande ovanpå, olöst. Enligt EU:s AI-förordning gäller transparenskrav för AI-modeller för allmänna ändamål oavsett var leverantören har sitt säte, och det är precis den typen av regulatorisk exponering som ett rent kostnadsbeslut ofta lämnar oprissatt.

Behandla priset per token som en variabel, inte en konstant

Det praktiska svaret har inget att göra med att överge DeepSeek eller någon annan leverantör och allt att göra med hur ett företag modellerar kostnadsraden från början: priset per token från någon AI-leverantör, västlig eller kinesisk, bör budgeteras som en variabel kopplad till perioder av högtrafikefterfrågan, inte som en fast post som fryses vid det pris man såg på registreringsdagen.

Det innebär att kontrollera en leverantörs avtalsvillkor för ensidiga prisändringar innan arbetsbelastningar skalas upp, att bygga den tekniska förmågan att flytta batch- eller icke-brådskande inferens till lågtrafiktimmar, och att hålla minst en alternativ leverantör utvärderad och redo, så att nästa 4,5-faldiga överraskning, oavsett om den kommer från DeepSeek eller någon annan leverantör som lovar ett permanent lågt pris, ändrar en budgetrad i stället för att tvinga fram en akut migration.