Bloomberg — DeepSeek presentó un modelo experimental de IA capaz de comprender indicaciones visuales, y afirmó que la herramienta se acerca al rendimiento de un modelo avanzado de su rival estadounidense Anthropic PBC.
La nueva versión es una versión experimental del modelo V4 Flash, el producto estrella de DeepSeek, que solo procesa texto, y que añade capacidades multimodales, lo que significa que también puede analizar y actuar sobre señales visuales como imágenes y capturas de pantalla, según anunció el viernes la empresa con sede en Hangzhou.
“Este modelo multimodal experimental iguala a DeepSeek-V4-Flash en capacidades de texto, incluidos agentes, razonamiento y conocimiento del mundo”, escribió la compañía en X.
Ver más: DeepSeek cuadruplica sus precios de suscripción, pero sigue siendo más barato que OpenAI y Claude
El rendimiento del modelo es “similar” al del avanzado modelo Opus 4.8 de Anthropic PBC en las pruebas de sus capacidades multimodales de agencia, en las que un modelo puede actuar sin supervisión constante ni indicaciones, según ha señalado la empresa.
DeepSeek ya había lanzado modelos multimodales y visuales, como la familia DeepSeek-VL. Sin embargo, esta nueva oferta, denominada DeepSeek-V4-Flash-Vision-Exp, añade la capacidad de interpretar imágenes y realizar tareas a su serie de modelos más avanzada. Los usuarios pueden acceder al modelo a través de la API de DeepSeek.
Las empresas chinas mantienen una intensa rivalidad con los desarrolladores estadounidenses de vanguardia en IA, y sus modelos suelen ofrecer un rendimiento similar a una fracción del precio. La llegada del modelo estrella de DeepSeek a principios de este año redefinió las expectativas sobre lo que podrían lograr los modelos de bajo costo y de libre acceso.
Lea más en Bloomberg.com













