DeepSeek udostępnia eksperymentalną warstwę wizyjną dla V4-Flash
DeepSeek opublikował DeepSeek-V4-Flash-Vision-Exp 21 sierpnia 2026 roku we własnym dzienniku zmian API, eksperymentalną wersję multimodalną modelu V4-Flash, która potrafi odczytywać obrazy oprócz tekstu. Model nosi identyfikator deepseek-v4-flash-vision-exp w API DeepSeek, a firma twierdzi, że w zadaniach czysto tekstowych, takich jak praca agentowa, rozumowanie i wiedza o świecie, wariant z wizją dorównuje oficjalnemu V4-Flash, więc nowa zdolność pojawia się bez deklarowanej utraty jakości.
Do tej pory praca multimodalna DeepSeek żyła w osobnej rodzinie modeli, DeepSeek-VL, oddzielonej od głównej linii V4, z której faktycznie korzysta większość programistów. Wraz z tym wydaniem wizja po raz pierwszy trafia bezpośrednio do linii V4-Flash, więc model, który już obsługuje rutynowy kod i zadania agentowe w niskiej cenie, może teraz przetwarzać także zrzuty ekranu, zeskanowane dokumenty i wykresy bez zmiany dostawcy.
Wyniki benchmarków zbliżają go do wiodącego zachodniego modelu
Własny dziennik zmian DeepSeek wymienia cztery wyniki dla nowego modelu: 83,9 w Terminal Bench 2.1, 57,7 w NL2Repo, 59,3 w DeepSWE oraz 64,3 w benchmarku Chartography, zbudowanym specjalnie do mierzenia rozumienia wykresów i dokumentów. DeepSeek twierdzi, że w benchmarkach agentowych wymagających rozumienia wizualnego model oferuje znaczący skok w porównaniu z oryginalnym V4-Flash i zbliża jego multimodalne zdolności agentowe do Opus 4.8 firmy Anthropic.
Niezależne doniesienia Deccan Chronicle potwierdzają, że model potrafi przetwarzać obrazy i zrzuty ekranu oraz działać na ich podstawie, i przedstawiają wydanie jako zaostrzenie rywalizacji USA i Chin w dziedzinie sztucznej inteligencji, zaznaczając, że modele DeepSeek zwykle dorównują zachodniej wydajności za ułamek kosztu. CryptoBriefing niezależnie doniósł o ujęciu, według którego model dorównuje Opus 4.8 w kluczowych benchmarkach przy kosztach eksploatacji niższych o około 99 procent - to szacunek prasowy dotyczący różnicy kosztów, a nie liczba opublikowana przez samo DeepSeek, dlatego cztery powyższe wyniki benchmarków pozostają najbardziej wiarygodną podstawą.
Pytanie zakupowe, przed którym stoją teraz europejscy operatorzy
Poważna multimodalna zdolność agentowa właśnie trafiła do jednej z najtańszych linii modeli na rynku, co zmienia rachunek, którego wiele europejskich zespołów jeszcze nie musiało robić. Jeśli tani, nieamerykański i nieeuropejski model potrafi teraz odczytać zrzut ekranu, zautomatyzować interfejs lub zinterpretować zeskanowaną umowę na poziomie zbliżonym do wiodącego zachodniego modelu, stare założenie, że zachodni dostawca zawsze jest bezpiecznym wyborem dla automatyzacji wrażliwej na koszty, staje się trudniejsze do obrony samą tylko zdolnością.
Trudniej jest go też obronić z punktu widzenia ryzyka, ponieważ ten sam skok poszerza już istniejącą ekspozycję zamiast ją usuwać. Obawy dotyczące suwerenności danych i kontroli eksportu, wcześniej podnoszone wobec czysto tekstowych modeli DeepSeek, dotyczą teraz również danych obrazowych i dokumentowych, kategorii często bardziej wrażliwej niż zwykły tekst - zrzuty ekranu wewnętrznych paneli, zeskanowane umowy, zdjęcia fizycznych dokumentów - dlatego wybór dostawcy dla europejskich nabywców staje się trudniejszy, a nie łatwiejszy.
Dlaczego etykieta Exp powinna studzić decyzję
Model nosi etykietę Exp, czyli eksperymentalny, a DeepSeek nie przedstawia go jako wydania gotowego do produkcji, co ma znaczenie dla każdej decyzji zakupowej opartej na tych liczbach. Etykieta eksperymentalna zwykle oznacza, że model może się zmienić, zostać wycofany lub zachowywać się niespójnie poza testowanymi warunkami benchmarku, więc traktowanie dzisiejszych wyników jako trwałej podstawy zdolności byłoby przedwczesne.
Oficjalne konto DeepSeek na X odniosło się do wydania razem z dziennikiem zmian API, a kilka mediów podchwyciło temat tego samego dnia, co wskazuje na firmę aktywnie szukającą porównania z Opus 4.8, a nie na liczbę, która wyciekła przypadkowo. Dla europejskiego nabywcy ten kontekst jest przydatny: pokazuje intencję marketingową DeepSeek przed jakąkolwiek rozmową zakupową, nie zmieniając faktu, że jest to model testowy, a nie gotowy produkt.
Czytaj dalej: Agenci AI zmówili się w sprawie cen, potem zaatakowali się | DeepSeek Kończy Wersję Testową po 4 Miesiącach, Idzie Podwyżka



