DeepSeek släpper ett experimentellt visionslager för V4-Flash
DeepSeek släppte DeepSeek-V4-Flash-Vision-Exp den 21 augusti 2026 i sin egen API-ändringslogg, en experimentell multimodal version av V4-Flash-modellen som kan läsa bilder utöver text. Modellen bär id:t deepseek-v4-flash-vision-exp i DeepSeeks API, och företaget uppger att den vid rena textuppgifter som agentarbete, resonemang och världskunskap presterar visionvarianten i nivå med officiella V4-Flash, så den nya förmågan kommer utan angiven kvalitetsförlust.
Fram tills nu låg DeepSeeks multimodala arbete i en separat familj, DeepSeek-VL, skild från V4-huvudlinjen som de flesta utvecklare faktiskt använder. Med den här lanseringen kommer vision för första gången direkt in i V4-Flash-linjen, så modellen som redan hanterar rutinkod och agentuppgifter till ett lågt pris nu också kan bearbeta skärmdumpar, skannade dokument och diagram utan att byta leverantör.
Benchmarksiffror för den nära en ledande västlig modell
DeepSeeks egen ändringslogg listar fyra siffror för den nya modellen: 83,9 i Terminal Bench 2.1, 57,7 i NL2Repo, 59,3 i DeepSWE och 64,3 i Chartography-benchmarken, som är byggd specifikt för att mäta förståelse av diagram och dokument. DeepSeek uppger att modellen på agentbenchmarks som kräver visuell förståelse levererar ett betydande lyft jämfört med det ursprungliga V4-Flash och för dess multimodala agentförmågor nära Anthropics Opus 4.8.
Oberoende rapportering från Deccan Chronicle bekräftar att modellen kan bearbeta bilder och skärmdumpar och agera utifrån dem, och beskriver lanseringen som en upptrappning av konkurrensen mellan USA och Kina inom AI, med noteringen att DeepSeeks modeller vanligtvis matchar västerländsk prestanda till en bråkdel av kostnaden. CryptoBriefing rapporterade separat om framställningen att modellen matchar Opus 4.8 på centrala benchmarks till ungefär 99 procent lägre driftskostnad - en pressuppskattning av kostnadsskillnaden, inte en siffra DeepSeek självt har publicerat, varför de fyra benchmarksiffrorna ovan förblir den mest pålitliga grunden.
Den upphandlingsfråga europeiska operatörer nu står inför
En allvarlig multimodal agentförmåga har just landat i en av de billigaste modellinjerna på marknaden, och det förändrar en kalkyl som många europeiska team ännu inte behövt göra. Om en billig, icke-amerikansk, icke-europeisk modell nu kan läsa en skärmdump, automatisera ett gränssnitt eller tolka ett skannat kontrakt på en nivå nära en ledande västlig modell, blir det gamla antagandet att en västlig leverantör alltid är det säkra valet för kostnadskänslig automatisering svårare att försvara enbart utifrån förmåga.
Det blir också svårare att försvara ur ett riskperspektiv, eftersom samma språng utökar en redan existerande exponering i stället för att ta bort den. Oron för datasuveränitet och exportkontroll som redan rests kring DeepSeeks rena textmodeller gäller nu även bild- och dokumentdata, en kategori som ofta är känsligare än vanlig text - skärmdumpar av interna dashboards, skannade kontrakt, foton av fysiska dokument - varför leverantörsvalet för europeiska inköpare blir svårare, inte lättare, att avgöra.
Varför märkningen Exp bör dämpa beslutet
Modellen bär märkningen Exp för experimentell, och DeepSeek presenterar den inte som en produktionsgaranterad lansering, vilket spelar roll för varje inköpsbeslut byggt på dessa siffror. En experimentell märkning betyder vanligtvis att modellen kan ändras, dras tillbaka eller bete sig inkonsekvent utanför de testade benchmarkförhållandena, så det vore förhastat att behandla dagens siffror som en permanent förmågebas.
DeepSeeks egna konto på X hänvisade till lanseringen tillsammans med API-ändringsloggen, och flera medier plockade upp historien samma dag, vilket pekar på ett företag som aktivt söker jämförelsen med Opus 4.8, snarare än en siffra som läckte av misstag. För en europeisk inköpare är det sammanhanget användbart: det avslöjar DeepSeeks marknadsföringsavsikt inför varje upphandlingssamtal, utan att ändra det faktum att det rör sig om en testmodell, inte en färdig produkt.
Läs vidare: AI-agenter samordnade priser, blev sedan fientliga | DeepSeek Lämnar Förhandsvisning Efter 4 Månader, Prishöjning Hotar



