Van vast tarief naar piekuurtoeslag bij DeepSeek

DeepSeeks eigen API-changelog toont de volgorde helder: V4-Pro bereikte algemene beschikbaarheid rond 12-13 augustus 2026, en slechts enkele dagen later, op 16 augustus, voerde DeepSeek een piekuurtarief in dat het vorige vaste tarief van 0,87 USD per miljoen output-tokens verving door een piekuurtarief van ongeveer 3,96 USD per miljoen output-tokens, een stijging van ongeveer 4,5 keer tijdens de drukste uren van de dag.

Unite.AI en Quartz bevestigden de wijziging onafhankelijk van elkaar en onderbouwen daarmee de vergelijking tussen vast tarief en piekuurtarief als het centrale feit van deze update. Minder stevig onderbouwd in diezelfde berichtgeving is het exacte daluurtarief dat DeepSeek nu rekent, dus dit artikel behandelt de sprong van vast naar piekuurtarief als het geverifieerde feit en laat het daluurcijfer open in plaats van een precisie te verzinnen die niet bestaat.

Vier cijfers die het echte verhaal vertellen

Naast elkaar gezet vatten vier cijfers de verschuiving beter samen dan enig verhaal: de datum van algemene beschikbaarheid van V4-Pro, het vaste tarief dat gold voor 16 augustus, het piekuurtarief dat nu geldt, en de vermenigvuldigingsfactor daartussen.

MijlpaalDatumDetail
Algemene beschikbaarheid van V4-Pro12-13/08/2026Volgens DeepSeeks eigen API-changelog
Eerder vast tarief (output-tokens)Tot en met 15/08/20260,87 USD per miljoen output-tokens
Nieuw piekuurtarief (output-tokens)Vanaf 16/08/2026Ongeveer 3,96 USD per miljoen output-tokens
Prijsvermenigvuldiger16/08/2026Ongeveer 4,5 keer tijdens piekuren

Gelezen als een tijdlijn in plaats van een tabel is het patroon dat een gloednieuw vlaggenschipmodel werd gelanceerd, en dat de onderliggende prijsstructuur binnen enkele dagen veranderde op een manier die niets te maken heeft met de capaciteit van het model en alles met de vraag op het uur waarop een bedrijf toevallig zijn werklast draait.

Goedkope AI was nooit een vaste kostenpost, het was een momentopname

Iedereen die ooit een cloudfactuur of een elektriciteitscontract heeft beheerd, kent deze dynamiek al: een gepubliceerde prijs is een momentopname van de actuele vraag en aanbod, geen belofte voor morgen, en de prijsstelling voor inferentie op een nieuw, populair model volgt precies dezelfde logica.

DeepSeek prijsde V4-Pro bij lancering laag genoeg om kostengevoelige werklasten weg te trekken van westerse topleveranciers, en die lage prijs was reëel, maar nooit contractueel vastgelegd zoals een langlopende bedrijfsovereenkomst dat kan zijn, het was een tarief dat de leverancier kon herzien op het moment dat de eigen infrastructuur een vraagplafond raakte, precies zoals dagen na de algemene beschikbaarheid gebeurde.

De lock-in-val die EU- en UK-kopers niet inprijsden

Veel Europese en Britse bedrijven verplaatsten werklasten naar DeepSeek precies omdat het aanzienlijk goedkoper was dan westerse topmodellen, een simpele kostenbeslissing die Servola eerder al besprak samen met DeepSeeks afzonderlijke EU-compliancekloof bij zijn eerdere V4-visiemodel, en precies die kostengedreven logica wordt door deze prijswijziging nu getest.

Een operator die puur op prijs overstapte, zonder de flexibiliteit in te bouwen om van leverancier te wisselen of werklast weg van piekuren te verplaatsen, blijft zitten met hetzelfde lock-in-risico waaraan hij dacht te ontsnappen door een westerse leverancier te verlaten, nu met minder contractueel en juridisch verhaal, en met de onderliggende data-soevereiniteitsblootstelling van een Chinese leverancier nog steeds erbovenop, onopgelost. Volgens de EU AI-verordening gelden transparantieverplichtingen voor AI-modellen voor algemene doeleinden ongeacht waar de leverancier is gevestigd, en dat is precies het soort regelgevende blootstelling die een puur op kosten gebaseerde beslissing meestal ongeprijsd laat.

Behandel de prijs per token als een variabele, niet als een constante

Het praktische antwoord heeft niets te maken met het opgeven van DeepSeek of enige andere leverancier en alles met hoe een bedrijf de kostenpost vanaf het begin modelleert: de prijs per token van welke AI-leverancier dan ook, westers of Chinees, zou moeten worden begroot als een variabele die is gekoppeld aan piekvraagperiodes, niet als een vaste post die is vastgevroren op de prijs die gold op de dag van aanmelding.

Dat betekent het controleren van de contractvoorwaarden van een leverancier over eenzijdige prijswijzigingen voordat werklasten opschalen, het opbouwen van de technische mogelijkheid om batch- of niet-urgente inferentie naar daluren te verplaatsen, en het klaar en geëvalueerd houden van minstens een alternatieve leverancier, zodat de volgende verrassing van 4,5 keer, of die van DeepSeek komt of van een andere leverancier die een permanent goedkoop tarief belooft, een budgetregel verandert in plaats van een noodmigratie af te dwingen.