Odaily星球日报 selon le compte WeChat de DeepSeek : DeepSeek a déployé le modèle de compréhension visuelle multimodale V4-Flash-Vision-Exp et a ouvert un service d’API.
Ce modèle, basé sur V4-Flash, a ajouté des capacités de compréhension d’images et de génération visuelle. Il prend en charge des entrées/sorties multimodales telles que le texte et les images, et propose aux développeurs des interfaces d’appel pour des capacités telles que l’inférence et la génération.
Ce modèle, basé sur V4-Flash, a ajouté des capacités de compréhension d’images et de génération visuelle. Il prend en charge des entrées/sorties multimodales telles que le texte et les images, et propose aux développeurs des interfaces d’appel pour des capacités telles que l’inférence et la génération.
