Informe diario Odaily, según la cuenta oficial de DeepSeek: DeepSeek ya ha lanzado el modelo de comprensión visual multimodal V4-Flash-Vision-Exp y ha abierto servicios de API.

Este modelo, basado en V4-Flash, incorpora capacidades de comprensión de imágenes y generación visual. Admite entradas y salidas multimodales como texto e imágenes, y ofrece a los desarrolladores interfaces para llamar capacidades como razonamiento y generación.