Fra fast pris til spidsbelastningstillæg hos DeepSeek

DeepSeeks egen API-ændringslog viser forløbet tydeligt: V4-Pro nåede almindelig tilgængelighed omkring den 12.-13. august 2026, og blot få dage senere, den 16. august, indførte DeepSeek en spidsbelastningspris, der afløste den tidligere faste pris på 0,87 USD per million output-tokens med en spidspris på omkring 3,96 USD per million output-tokens, en stigning på cirka 4,5 gange i døgnets mest belastede timer.

Unite.AI og Quartz bekræftede ændringen uafhængigt af hinanden og underbyggede dermed sammenligningen mellem fast pris og spidspris som opdateringens centrale faktum. Hvad der er mindre solidt dokumenteret i samme dækning, er den præcise pris uden for spidsbelastning, som DeepSeek nu opkræver, så denne artikel behandler springet fra fast til spidspris som det bekræftede faktum og lader tallet for lavlast stå åbent i stedet for at opfinde en præcision, der ikke findes.

Fire tal, der fortæller den egentlige historie

Stillet op ved siden af hinanden opsummerer fire tal skiftet bedre end enhver fortælling: datoen for V4-Pros almindelige tilgængelighed, den faste pris, der gjaldt inden 16. august, spidsprisen, der gælder nu, og multiplikatoren mellem dem.

MilepælDatoDetalje
Almindelig tilgængelighed for V4-Pro12.-13.08.2026Ifølge DeepSeeks egen API-ændringslog
Tidligere fast pris (output-tokens)Til og med 15.08.20260,87 USD per million output-tokens
Ny spidsbelastningspris (output-tokens)Fra 16.08.2026Omkring 3,96 USD per million output-tokens
Prismultiplikator16.08.2026Cirka 4,5 gange i spidsbelastning

Læst som en tidslinje snarere end en tabel er mønsteret, at en helt ny flagskibsmodel blev lanceret, og at prisstrukturen bag den inden for få dage ændrede sig på en måde, der intet har at gøre med modellens kapacitet og alt at gøre med efterspørgslen i den time, hvor en virksomhed nu engang kører sin arbejdsbelastning.

Billig AI var aldrig en fast omkostning, det var et snapshot

Alle, der har administreret en cloud-regning eller en elkontrakt, kender allerede denne dynamik: en offentliggjort pris er et snapshot af det aktuelle udbud og efterspørgsel, ikke et løfte om i morgen, og prisen på inferens i en ny, populær model følger nøjagtig samme logik.

DeepSeek prissatte V4-Pro lavt nok ved lanceringen til at trække omkostningsfølsomme arbejdsbelastninger væk fra vestlige topleverandører, og den lave pris var reel, men den var aldrig kontraktligt fastlåst på samme måde som en langsigtet virksomhedsaftale kan være, det var en pris, leverandøren kunne ændre i det øjeblik, dens egen infrastruktur ramte et efterspørgselsloft, præcis som det skete få dage efter den almindelige tilgængelighed.

Lock-in-risikoen, som EU- og UK-købere ikke prissatte

Mange europæiske og britiske virksomheder flyttede arbejdsbelastninger til DeepSeek netop fordi det var markant billigere end vestlige topmodeller, en enkel omkostningsbeslutning, som Servola tidligere har dækket sammen med DeepSeeks separate EU-efterlevelseshul på dets tidligere V4-visionsmodel, og det er netop denne omkostningsdrevne logik, som denne prisændring nu sætter på prøven.

En operatør, der skiftede alene på grund af prisen, uden at indbygge flexibiliteten til at skifte leverandør eller flytte arbejdsbelastningen uden om spidsbelastningstimerne, står nu med samme lock-in-risiko, som de troede de slap fra ved at forlade en vestlig leverandør, nu med mindre kontraktlig og juridisk retsstilling, og med den underliggende eksponering for datasuverænitet ved brug af en kinesisk leverandør stadig ovenpå, uløst. Ifølge EU's AI-forordning gælder gennemsigtighedskrav for generelle AI-modeller uanset hvor leverandøren har sit hjemsted, og det er netop den slags regulatoriske eksponering, en ren omkostningsbeslutning som regel efterlader uprissat.

Behandl prisen per token som en variabel, ikke en konstant

Det praktiske svar har intet at gøre med at opgive DeepSeek eller nogen anden leverandør og alt at gøre med, hvordan en virksomhed modellerer omkostningslinjen fra begyndelsen: prisen per token fra enhver AI-leverandør, vestlig eller kinesisk, bør budgetteres som en variabel knyttet til perioder med spidsefterspørgsel, ikke som en fast post frosset til den pris, man så på tilmeldingsdagen.

Det betyder at kontrollere en leverandørs kontraktvilkår for ensidige prisændringer, inden arbejdsbelastninger skaleres op, at opbygge den tekniske evne til at flytte batch- eller ikke-akut inferens til timer uden for spidsbelastning, og at holde mindst en alternativ leverandør evalueret og klar, så den næste 4,5-dobbelte overraskelse, om den kommer fra DeepSeek eller fra en anden leverandør, der lover en permanent billig pris, ændrer en budgetlinje i stedet for at tvinge en akut migration.