DeepSeek pubblica uno strato di visione sperimentale per V4-Flash
DeepSeek ha pubblicato DeepSeek-V4-Flash-Vision-Exp il 21 agosto 2026 nel proprio registro modifiche dell'API, una versione multimodale sperimentale del modello V4-Flash capace di leggere immagini oltre al testo. Il modello porta l'identificativo deepseek-v4-flash-vision-exp nell'API di DeepSeek, e l'azienda afferma che sui compiti di solo testo, come lavoro d'agente, ragionamento e conoscenza del mondo, la variante con visione eguaglia il V4-Flash ufficiale, quindi la nuova capacità arriva senza un calo di qualità dichiarato.
Finora il lavoro multimodale di DeepSeek viveva in una famiglia separata, DeepSeek-VL, tenuta distinta dalla linea principale V4 che la maggior parte degli sviluppatori usa davvero. Con questo rilascio la visione entra per la prima volta direttamente nella linea V4-Flash, cosicché il modello che gestisce già codice di routine e compiti d'agente a basso prezzo può ora anche elaborare screenshot, documenti scansionati e grafici senza cambiare fornitore.
I punteggi dei benchmark lo avvicinano a un modello occidentale di riferimento
Il registro modifiche di DeepSeek elenca quattro punteggi per il nuovo modello: 83,9 su Terminal Bench 2.1, 57,7 su NL2Repo, 59,3 su DeepSWE e 64,3 sul benchmark Chartography, costruito appositamente per misurare la comprensione di grafici e documenti. DeepSeek afferma che sui benchmark d'agente che richiedono comprensione visiva il modello offre un salto significativo rispetto al V4-Flash originale e avvicina le sue capacità di agente multimodale a Opus 4.8 di Anthropic.
La copertura indipendente di Deccan Chronicle conferma che il modello può elaborare immagini e screenshot e agire di conseguenza, e presenta il rilascio come un'intensificazione della competizione tra Stati Uniti e Cina nell'intelligenza artificiale, notando che i modelli DeepSeek raggiungono tipicamente prestazioni occidentali a una frazione del costo. CryptoBriefing ha riportato separatamente l'idea che il modello eguagli Opus 4.8 sui benchmark chiave con un costo operativo di circa il 99 per cento inferiore - una stima della stampa sul divario di costo, non una cifra pubblicata da DeepSeek, motivo per cui i quattro punteggi dei benchmark sopra restano la base più affidabile.
La domanda di procurement che ora affrontano gli operatori europei
Una seria capacità di agente multimodale è appena arrivata in una delle linee di modelli più economiche del mercato, e questo cambia un calcolo che molti team europei non avevano ancora dovuto affrontare. Se un modello economico, non statunitense e non europeo, ora riesce a leggere uno screenshot, automatizzare un'interfaccia o interpretare un contratto scansionato a un livello vicino a quello di un modello occidentale di riferimento, la vecchia ipotesi che un fornitore occidentale sia sempre la scelta sicura per l'automazione sensibile al costo diventa più difficile da giustificare sulla sola base delle capacità.
Diventa più difficile da giustificare anche sul piano del rischio, perché lo stesso salto amplia un'esposizione già esistente invece di eliminarla. Le preoccupazioni di sovranità dei dati e controllo delle esportazioni già sollevate per i modelli DeepSeek di solo testo si applicano ora anche ai dati di immagini e documenti, una categoria spesso più sensibile del semplice testo - screenshot di dashboard interne, contratti scansionati, foto di documenti fisici - motivo per cui la scelta del fornitore per gli acquirenti europei diventa più difficile, non più semplice, da risolvere.
Perché l'etichetta Exp dovrebbe frenare la decisione
Il modello porta l'etichetta Exp per sperimentale, e DeepSeek non lo presenta come un rilascio pronto per la produzione, un dettaglio importante per qualsiasi decisione d'acquisto basata su questi numeri. Un'etichetta sperimentale in genere significa che il modello può cambiare, essere ritirato o comportarsi in modo incoerente fuori dalle condizioni di benchmark in cui è stato testato, quindi trattare i punteggi di oggi come una base di capacità permanente sarebbe prematuro.
L'account ufficiale di DeepSeek su X ha citato il rilascio insieme al registro modifiche dell'API, e diverse testate hanno ripreso la notizia lo stesso giorno, il che indica un'azienda che cerca attivamente il confronto con Opus 4.8, non un dato trapelato per errore. Per un acquirente europeo questo contesto è utile: rivela l'intenzione di marketing di DeepSeek prima di qualsiasi conversazione di procurement, senza cambiare il fatto che si tratta di un modello di prova, non di un prodotto finito.
Da leggere ora: Agenti IA hanno fissato i prezzi, poi sono diventati ostili | DeepSeek Lascia l'Anteprima Dopo 4 Mesi, Rialzo in Arrivo



