Flagowy model zdejmuje etykietę wersji testowej
DeepSeek przeniósł swój flagowy model V4 Pro z wersji testowej do ogólnej dostępności 12 sierpnia 2026 roku, kończąc okres testów trwający od 24 kwietnia. Kompilacja nosi etykietę wersji 0813 i idzie w ślady mniejszego wariantu V4-Flash, który ten sam krok ku oficjalnemu statusowi wykonał już 31 lipca. Oba modele działają teraz w produkcyjnym API DeepSeek, a nie w warstwie testowej, w której programiści byli ostrzegani o zmianach bez zapowiedzi.
V4 Pro zachowuje okno kontekstu o długości miliona tokenów, które miał już w wersji testowej, z maksymalnym wyjściem 384000 tokenów na zapytanie. DeepSeek zbudował model jako system typu mixture-of-experts z 1,6 biliona parametrów łącznie, z których 49 miliardów aktywuje się dla każdego pojedynczego tokena, ten sam wzorzec architektury, którego firma używa od V3, aby utrzymać niskie koszty obsługi przy jednoczesnym skalowaniu całkowitej pojemności.
Rachunek efektywności za 1,6 biliona parametrów
Nagłówkiem nie jest liczba parametrów, lecz to, jak tanio DeepSeek potrafi je obsługiwać. Nowy mechanizm uwagi, który firma nazywa Compressed Sparse Attention, w połączeniu z tym, co określa jako Heavily Compressed Attention, obniża obliczenia potrzebne na token wnioskowania do 27 procent tego, czego wymagał poprzedni model V3.2, i zmniejsza chłonną pamięciowo pamięć podręczną klucz-wartość do 10 procent wcześniejszego rozmiaru.
W testach porównawczych V4 Pro rozwiązuje 80,6 procent zadań SWE-bench Verified, na równi z Gemini-3.1-Pro od Google w tym samym teście, i osiąga wskaźnik zaliczenia 90,1 procent w GPQA Diamond oraz 93,5 procent w LiveCodeBench. Pozostaje w tyle za GPT-5.4 od OpenAI w Terminal Bench 2.0, z wynikiem 67,9 wobec 75,1, i notuje ocenę Codeforces na poziomie 3206, co dowodzi, że DeepSeek jest teraz porównywany z wiodącymi amerykańskimi laboratoriami, a nie obok nich.
O 98 procent taniej, i to niedługo się skończy
Przy ogólnej dostępności V4 Pro kosztuje 0,435 dolara za milion tokenów wejściowych przy braku trafienia w pamięci podręcznej, 0,003625 dolara za milion przy trafieniu, i 0,87 dolara za milion tokenów wyjściowych, bez zmian wobec wersji testowej. Tańszy poziom V4-Flash kosztuje 0,14 dolara za milion tokenów wejściowych i 0,28 dolara za wyjściowe. Firma badawcza Artificial Analysis zmierzyła faktyczny koszt V4-Flash na około 0,03 dolara za zadanie testowe, wobec 1,86 dolara za GPT-5.6 Sol od OpenAI i 3,15 dolara za Claude Fable 5 od Anthropic, różnica przekraczająca 98 procent.
W tym samym okresie co premiera V4 Pro strona dokumentacji dla programistów DeepSeek zawierała osobne ostrzeżenie: ogólna cena API znacząco wzrośnie w najbliższej przyszłości, choć firma nie podała ani daty, ani procentu. Programistów poproszono o zaplanowanie użycia odpowiednio do tego, a ostateczna struktura cenowa ma zostać ogłoszona osobno, co jest niecodziennym przyznaniem, że dzisiejszy cennik nie jest tym, na którym klienci powinni opierać swój budżet.
Pozycja budzetowa, która właśnie stała się zmienna
Czas ma większe znaczenie niż liczba. DeepSeek ostrzega przed przeceną w tym samym cyklu wydawniczym, który dopiero co nadał V4 Pro status produkcyjny, co sygnalizuje zespołom zakupowym, że niezawodność modelu dojrzała wcześniej niż jego koszt. Limit 500 równoczesnych zapytań na końcówce Pro, jedna piąta pułapu 2500 na tańszym poziomie Flash, to drugi sygnał w tym samym kierunku: pojemność droższego, wyższej jakości poziomu jest ograniczeniem, którym DeepSeek zarządza w pierwszej kolejności, a cena jest dźwignią, jaka mu pozostała.
Firmy, które przeniosły obciążenia do chińskich modeli specjalnie po to, by uciec od nieprzewidywalnych amerykańskich cen, teraz noszą to samo ryzyko z przeciwnego kierunku, bez dolnej granicy i bez daty w kalendarzu. Wyłącznie jako ilustracja, nie prognoza: dla warszawskiego integratora sektora publicznego, który budżetuje w złotych, wzrost z około 3,5 do 6 złotych za milion tokenów wyjściowych przy obciążeniu rzędu kilku miliardów tokenów miesięcznie zamieniłby błąd zaokrąglenia w sześciocyfrowe roczne wahnięcie, a DeepSeek nie dał żadnej gwarancji, że podwyżka na tym się zatrzyma. Traktowanie subsydiowanego cennika jako stałej pozycji w budżecie wieloletnim zawsze było zakładem, że przeceniony rynek pozostanie w miejscu; dostawca powiedział teraz, we własnej dokumentacji, że tak się nie stanie.
Czytaj dalej: Model się zmienił, nazwa API nie | Godziny pracy Pekinu ustalają twój rachunek za AI



