Mejlet kom tre veckor före priset

Den 29 juni 2026 skrev DeepSeek till sina utvecklare och lade ut ett meddelande på sin öppna plattform: den officiella V4-versionen skulle komma i mitten av juli, och den skulle komma med två priser i stället för ett. Den kom den 19 juli. Prissidan i utvecklardokumentationen anger fortfarande en enda fast taxa per modell.

Just glappet mellan det som aviserades och det som publicerats är vad som räknas för var och en som skickar produktionstrafik genom gränssnittet. DeepSeek har lovat ett varsel på 24 timmar innan en justering träder i kraft. Tjugofyra timmar räcker för att skicka ett mejl. De räcker inte för att flytta en arbetslast.

Två priser, en klocka, och klockan står i Peking

De aviserade toppfönstren går från 09:00 till 12:00 och från 14:00 till 18:00 Pekingtid, och anrop inom dem kostar dubbelt mot normaltaxan. I yuan går V4 Pro-utdata från 6 till 12 per miljon tokens och V4 Flash-utdata från 2 till 4. De publicerade fasta taxorna är 0,87 dollar per miljon utdatatokens för Pro och 0,28 för Flash, med indata utan cacheträff på 0,435 och 0,14. Det lägger Pro-utdata kring 0,75 euro per miljon tokens, innan något tillägg alls slår till.

Peking ligger på sommaren sex timmar före Stockholm och sju före London. Det andra toppfönstret faller därmed mellan 08:00 och 12:00 i Stockholm och mellan 07:00 och 11:00 i London. Ett europeiskt team betalar tillägget över sin egen arbetsförmiddag och är tillbaka på normaltaxan hela eftermiddagen. Det första fönstret, 09:00 till 12:00 i Peking, motsvarar 03:00 till 06:00 i Stockholm, och just där lägger de flesta europeiska hus sina nattliga batchkörningar.

Den tidsfrist du ser är den lilla

Dokumentationen anger ett hårt datum. Namnen deepseek-chat och deepseek-reasoner slutar kännas igen den 24 juli 2026 klockan 15:59 UTC. Båda var alias för det icke-resonerande och det resonerande läget i det som i dag heter deepseek-v4-flash. Botemedlet är alltså en ändrad teckensträng i ett modellfält och inget mer.

Det är den fristen varje team agerar på, eftersom den syns och eftersom den fallerar högljutt. Prisklockan fallerar ljudlöst. Ingenting går sönder, inget larm går, och fakturan dubblas helt enkelt under en del av dygnet enligt en arbetskalender som är satt på en marknad där köparen inte alls är verksam.

Vad en utomstående utvärdering fann under priset

Det amerikanska Center for AI Standards and Innovation publicerade en egen utvärdering av DeepSeek V4 Pro, och dess siffror stämmer inte med bolagets. CAISI satte V4 Pro på ett Elo om 800 mot 1260 för GPT-5.5 och 749 för GPT-5.4 mini, bedömde modellen ungefär åtta månader efter de ledande modellerna och mätte 46 procent på den undanhållna ARC-AGI-2-mängden mot 79 procent. Utvärderingen fann också att bolaget hade lagt fram sina egna resultat selektivt.

Samma utvärdering fann V4 billigare än den jämförbara amerikanska modellen på fem av sju prov, i ett spann från 53 procent billigare till 41 procent dyrare. Så ser affären ut när man är ärlig: en verklig rabatt mot ett verkligt kapacitetsgap. Rabatten är den halva som nu rör sig två gånger om dygnet.

Prissätt klockan, inte token

Två punkter hör hemma i nästa leverantörsgenomgång. Flytta varje arbetslast som kan vänta ut ur 03:00 till 06:00 och 08:00 till 12:00 centraleuropeisk sommartid, för det är de dyra timmarna och den europeiska eftermiddagen är det inte. Lägg sedan varselfristen på 24 timmar framför den som skriver under budgeten, för ett styckpris som kan dubblas med en dags varsel är ett affärsvillkor och ingen teknisk detalj.

Den andra punkten är ett dirigeringsbeslut. Om en arbetslast inte kan bära ett dubblat styckpris under en europeisk förmiddag behöver den en andra leverantör som är uppsatt, provad och prissatt innan den förmiddagen kommer. Att bygga den vägen efter varselmejlet betyder att bygga den på 24 timmar.