De e-mail kwam drie weken voor de prijs

Op 29 juni 2026 schreef DeepSeek zijn ontwikkelaars aan en plaatste een bericht op het open platform: de officiele V4-versie zou medio juli komen, en die zou komen met twee prijzen in plaats van een. Ze verscheen op 19 juli. De prijspagina in de ontwikkelaarsdocumentatie noemt nog steeds een enkel vast tarief per model.

Juist dat gat tussen wat is aangekondigd en wat is gepubliceerd telt voor iedereen die productieverkeer over de interface stuurt. DeepSeek heeft een aankondiging van 24 uur beloofd voordat een aanpassing ingaat. Vierentwintig uur is genoeg om een e-mail te sturen. Het is niet genoeg om een werklast te verhuizen.

Twee prijzen, een klok, en die klok staat in Peking

De aangekondigde piekvensters lopen van 09:00 tot 12:00 en van 14:00 tot 18:00 uur Pekingse tijd, en aanroepen die daarbinnen vallen kosten het dubbele van het normale tarief. In yuan gaat de uitvoer van V4 Pro van 6 naar 12 per miljoen tokens en die van V4 Flash van 2 naar 4. De gepubliceerde vaste tarieven zijn 0,87 dollar per miljoen uitvoertokens voor Pro en 0,28 voor Flash, met invoer zonder cachetreffer op 0,435 en 0,14. Daarmee komt de uitvoer van Pro rond 0,75 euro per miljoen tokens uit, nog voor enige toeslag.

Peking loopt in de zomer zes uur voor op Amsterdam en zeven op Londen. Het tweede piekvenster valt daarmee tussen 08:00 en 12:00 uur in Amsterdam en tussen 07:00 en 11:00 uur in Londen. Een Europees team betaalt de toeslag over zijn eigen werkochtend en krijgt de hele middag het normale tarief. Het eerste venster, 09:00 tot 12:00 uur in Peking, komt neer op 03:00 tot 06:00 uur in Amsterdam, precies waar de meeste Europese huizen hun nachtelijke batchruns neerzetten.

De zichtbare deadline is de kleine

De documentatie noemt een harde datum. De namen deepseek-chat en deepseek-reasoner worden op 24 juli 2026 om 15:59 UTC niet langer herkend. Beide waren aliassen voor de niet-redenerende en de redenerende modus van wat nu deepseek-v4-flash heet. Het middel is dus een gewijzigde tekenreeks in een modelveld en niets meer.

Dat is de deadline waar elk team op reageert, want hij is zichtbaar en hij gaat luidruchtig mis. De prijsklok gaat geruisloos mis. Er gaat niets stuk, er klinkt geen alarm, en de factuur verdubbelt gewoon voor een deel van de dag, volgens een werkkalender die is vastgesteld op een markt waar de koper niet eens actief is.

Wat een externe evaluatie onder de prijs vond

Het Amerikaanse Center for AI Standards and Innovation publiceerde een eigen evaluatie van DeepSeek V4 Pro, en de cijfers daarvan komen niet overeen met die van het bedrijf. CAISI zette V4 Pro op een Elo van 800 tegen 1260 voor GPT-5.5 en 749 voor GPT-5.4 mini, achtte het model ongeveer acht maanden achter de koplopers en mat 46 procent op de achtergehouden ARC-AGI-2-set tegen 79 procent. Ook stelde de evaluatie vast dat het bedrijf zijn eigen resultaten selectief had gepresenteerd.

Dezelfde evaluatie vond V4 goedkoper dan het vergelijkbare Amerikaanse model op vijf van de zeven tests, in een band die loopt van 53 procent goedkoper tot 41 procent duurder. Zo ziet de ruil er eerlijk uit: een echte korting tegenover een echt capaciteitsverschil. De korting is de helft die nu twee keer per dag beweegt.

Zet de prijs op de klok, niet op het token

Twee punten horen thuis in de volgende leveranciersbeoordeling. Haal elke werklast die kan wachten weg uit 03:00 tot 06:00 en 08:00 tot 12:00 uur Midden-Europese zomertijd, want dat zijn de dure uren en de Europese middag is dat niet. Leg vervolgens die aankondigingstermijn van 24 uur voor aan degene die het budget tekent, want een eenheidsprijs die met een dag waarschuwing kan verdubbelen is een commerciële voorwaarde en geen technisch detail.

Het tweede punt is een routeringsbesluit. Kan een werklast een verdubbelde eenheidsprijs tijdens een Europese ochtend niet dragen, dan heeft die een tweede leverancier nodig die is ingericht, getest en geprijsd voordat die ochtend aanbreekt. Dat pad pas na de aankondigingsmail bouwen betekent het in 24 uur bouwen.