DeepSeek lanza una capa de visión experimental para V4-Flash
DeepSeek publicó DeepSeek-V4-Flash-Vision-Exp el 21 de agosto de 2026 en su propio registro de cambios de la API, una versión multimodal experimental de su modelo V4-Flash capaz de leer imágenes además de texto. El modelo lleva el identificador deepseek-v4-flash-vision-exp en la API de DeepSeek, y la empresa afirma que en tareas de puro texto, como trabajo de agentes, razonamiento y conocimiento del mundo, la variante con visión iguala al V4-Flash oficial, por lo que la nueva capacidad llega sin una pérdida de calidad declarada.
Hasta ahora, el trabajo multimodal de DeepSeek vivía en una familia aparte, DeepSeek-VL, separada de la línea principal V4 que la mayoría de los desarrolladores realmente despliega. Con este lanzamiento, la visión entra por primera vez directamente en la línea V4-Flash, de modo que el modelo que ya maneja código rutinario y tareas de agente a un precio bajo puede ahora también procesar capturas de pantalla, documentos escaneados y gráficos sin cambiar de proveedor.
Las cifras de los benchmarks lo acercan a un modelo occidental de referencia
El propio registro de cambios de DeepSeek enumera cuatro cifras para el nuevo modelo: 83,9 en Terminal Bench 2.1, 57,7 en NL2Repo, 59,3 en DeepSWE y 64,3 en el benchmark Chartography, diseñado específicamente para medir la comprensión de gráficos y documentos. DeepSeek afirma que en los benchmarks de agentes que requieren comprensión visual, el modelo ofrece un salto significativo respecto al V4-Flash original y acerca sus capacidades de agente multimodal a Opus 4.8 de Anthropic.
La cobertura independiente de Deccan Chronicle confirma que el modelo puede procesar imágenes y capturas de pantalla y actuar sobre ellas, y presenta el lanzamiento como una intensificación de la competencia entre Estados Unidos y China en inteligencia artificial, señalando que los modelos de DeepSeek suelen igualar el rendimiento occidental a una fracción del coste. CryptoBriefing informó por separado del planteamiento de que el modelo iguala a Opus 4.8 en benchmarks clave con un coste de funcionamiento aproximadamente un 99 por ciento menor - una estimación de la prensa sobre la brecha de coste, no una cifra publicada por DeepSeek, por lo que las cuatro puntuaciones de benchmark anteriores siguen siendo la base más fiable.
La pregunta de compras que ahora enfrentan los operadores europeos
Una capacidad seria de agente multimodal acaba de llegar a una de las líneas de modelos más baratas del mercado, y eso cambia un cálculo que muchos equipos europeos aún no habían tenido que hacer. Si un modelo barato, no estadounidense y no europeo, puede ahora leer una captura de pantalla, automatizar una interfaz o interpretar un contrato escaneado a un nivel cercano al de un modelo occidental de referencia, la vieja suposición de que pagar una prima por un proveedor occidental es siempre la opción segura para automatización sensible al coste se vuelve más difícil de justificar solo por capacidad.
También se vuelve más difícil de justificar por riesgo, porque el mismo salto amplía una exposición ya existente en lugar de eliminarla. Las preocupaciones de soberanía de datos y control de exportaciones ya planteadas para los modelos de DeepSeek de solo texto se aplican ahora también a datos de imagen y documentos, una categoría a menudo más sensible que el texto plano - capturas de dashboards internos, contratos escaneados, fotografías de documentos físicos -, por lo que la decisión de proveedor para los compradores europeos se vuelve más difícil, no más fácil, de resolver.
Por qué la etiqueta Exp debería frenar la decisión
El modelo lleva la etiqueta Exp de experimental, y DeepSeek no lo presenta como un lanzamiento listo para producción, algo importante para cualquier decisión de compra basada en estas cifras. Una etiqueta experimental suele significar que el modelo puede cambiar, retirarse o comportarse de forma inconsistente fuera de las condiciones de benchmark en las que fue probado, por lo que tratar las cifras de hoy como una base de capacidad permanente sería prematuro.
La propia cuenta de DeepSeek en X hizo referencia al lanzamiento junto con el registro de cambios de la API, y varios medios recogieron la noticia el mismo día, lo que apunta a una empresa que busca activamente la comparación con Opus 4.8, no a un dato filtrado sin querer. Para un comprador europeo, ese contexto es útil: revela la intención de marketing de DeepSeek antes de cualquier conversación de compras, sin cambiar el hecho de que se trata de un modelo de prueba, no de un producto terminado.
Leer a continuación: Agentes de IA pactaron precios, luego atacaron | DeepSeek Sale de Vista Previa Tras 4 Meses; Llega Subida



