Da tarifa fixa a sobretaxa de hora de ponta na DeepSeek

O próprio registo de alterações da API da DeepSeek mostra a sequência com clareza: o V4-Pro atingiu a disponibilidade geral por volta de 12 ou 13 de agosto de 2026, e apenas alguns dias depois, a 16 de agosto, a DeepSeek introduziu uma tarifa de hora de ponta que substituiu a tarifa fixa anterior de 0,87 USD por milhão de tokens de saída por uma tarifa de ponta de cerca de 3,96 USD por milhão de tokens de saída, um salto de cerca de 4,5 vezes durante as horas mais movimentadas do dia.

A Unite.AI e a Quartz confirmaram a alteração de forma independente, sustentando a comparação entre tarifa fixa e tarifa de ponta como o facto central da atualização. O que fica menos consolidado nessa mesma cobertura é a tarifa exata fora da hora de ponta que a DeepSeek cobra agora, pelo que este artigo trata o salto de tarifa fixa para tarifa de ponta como o facto verificado e deixa em aberto o número fora de ponta em vez de inventar uma precisão que não existe.

Quatro números que contam a história real

Colocados lado a lado, quatro números resumem a mudança melhor do que qualquer narrativa: a data de disponibilidade geral do V4-Pro, a tarifa fixa em vigor antes de 16 de agosto, a tarifa de ponta agora em vigor, e o multiplicador entre as duas.

MarcoDataDetalhe
Disponibilidade geral do V4-Pro12-13/08/2026Segundo o próprio registo de alterações da API da DeepSeek
Tarifa fixa anterior (tokens de saída)Até 15/08/20260,87 USD por milhão de tokens de saída
Nova tarifa de hora de ponta (tokens de saída)A partir de 16/08/2026Cerca de 3,96 USD por milhão de tokens de saída
Multiplicador de preço16/08/2026Aproximadamente 4,5 vezes em hora de ponta

Lida como uma linha temporal e não como uma tabela, o padrão é que um modelo principal recém-chegado foi lançado, e em poucos dias a estrutura de preços subjacente mudou de uma forma que nada tem a ver com a capacidade do modelo e tudo a ver com a procura na hora em que uma empresa acontece fazer correr a sua carga de trabalho.

A IA barata nunca foi um custo fixo, era uma fotografia do momento

Quem já geriu uma fatura de cloud ou um contrato de eletricidade já conhece esta dinâmica: um preço publicado é uma fotografia da oferta e da procura do momento, não uma promessa sobre o dia de amanhã, e o preço da inferência num modelo novo e popular segue exatamente a mesma lógica.

A DeepSeek fixou o preço do V4-Pro suficientemente baixo no lançamento para atrair cargas sensíveis ao custo, afastando-as dos fornecedores ocidentais de ponta, e esse preço baixo era real, mas nunca foi fixado por contrato como pode ser um acordo empresarial de longo prazo, era uma tarifa que o fornecedor podia rever no momento em que a sua própria infraestrutura atingisse um limite de procura, exatamente como aconteceu dias depois da disponibilidade geral.

A armadilha de dependência que os compradores da UE e do Reino Unido não calcularam

Muitas empresas europeias e britânicas mudaram cargas para a DeepSeek precisamente porque era muito mais barata do que os modelos ocidentais de ponta, uma decisão de custo simples que a Servola já tinha noticiado a par da lacuna de conformidade da DeepSeek na UE no seu anterior modelo de visão V4, e é precisamente essa lógica centrada no custo que esta alteração de preços agora põe à prova.

Um operador que mudou apenas pelo preço, sem incorporar a flexibilidade de mudar de fornecedor ou de deslocar a carga para fora da hora de ponta, fica com o mesmo risco de dependência de que pensava estar a escapar ao deixar um fornecedor ocidental, agora com menos recurso contratual e legal, e com a exposição à soberania de dados do uso de um fornecedor chinês ainda por resolver em cima. Segundo o Regulamento de IA da UE, as obrigações de transparência para modelos de IA de uso geral aplicam-se independentemente de onde o fornecedor tem a sua sede, e é exatamente este o tipo de exposição regulatória que uma decisão puramente de custo tende a deixar por calcular.

Tratar o preço por token como uma variável, não como uma constante

A resposta prática nada tem a ver com abandonar a DeepSeek ou qualquer outro fornecedor e tudo a ver com a forma como uma empresa modela a linha de custo desde o início: o preço por token de qualquer fornecedor de IA, ocidental ou chinês, deveria ser orçamentado como uma variável ligada aos períodos de procura de ponta, e não como uma rubrica fixa congelada ao preço visto no dia da adesão.

Isso significa verificar as condições contratuais de um fornecedor sobre alterações unilaterais de preço antes de escalar as cargas, construir a capacidade técnica de deslocar a inferência em lote ou não urgente para as horas fora de ponta, e manter pelo menos um fornecedor alternativo avaliado e pronto, para que a próxima surpresa de 4,5 vezes, seja da DeepSeek ou de qualquer outro fornecedor a prometer uma tarifa permanentemente barata, altere uma rubrica de orçamento em vez de forçar uma migração de emergência.