DeepSeek desafía a Anthropic con una nueva IA multimodal que planta cara al modelo Opus 4.8

2026/08/24

La compañía DeepSeek ha lanzado un modelo multimodal experimental que supera a Opus 4.8 de Anthropic en tres de once pruebas para medir y comparar de forma objetiva el rendimiento de los modelos de inteligencia artificial en tareas específicas.

La innovación se llama DeepSeek-V4-Flash-Vision-Exp y añade capacidad de visión al modelo previo V4-Flash, lo que le permite interpretar imágenes y capturas de pantalla para ampliar sus posibilidades de uso. Además, comparado con la versión V4-Flash de solo texto, este modelo experimental lo supera en seis de las siete evaluaciones de texto y admite el envío de imágenes, de modo que una foto o captura de pantalla se traduce en unidades que se cobran al precio del texto estándar.

También, la API de archivos permite subir una imagen una sola vez y reutilizarla en todas las consultas posteriores, sin necesidad de volver a cargarla cada vez. En este contexto, así lo afirma DeepSeek en una publicación de  la red social X (antes Twitter): "Este modelo multimodal experimental iguala a DeepSeek-V4-Flash en capacidades de texto, incluyendo agentes, razonamiento y conocimiento del mundo".

En cuanto al rendimiento, el laboratorio de IA asegura que DeepSeek logra superar a Opus 4.8 en tres de las once pruebas realizadas —DeepSWE, Agents' Last Exam y ZeroBench—. En las ocho restantes, el modelo queda por debajo, con una diferencia de hasta doce puntos en NL2Repo —es decir, el benchmark que evalúa su capacidad para resolver tareas complejas en repositorios—.

Cabe mencionar que DeepSeek ha integrado el nuevo modelo en su plataforma de API y ha actualizado a la versión 0.1.1 su entorno para agentes, que ahora también ofrece compatibilidad con este modelo. A esto se suma su reducido coste de procesamiento que, según TNW, un millón de palabras cuesta 0,87 dólares, frente a los cerca de 50 dólares que supone procesar la misma cantidad con Opus 4.8 de Anthropic.