Notícia do Odaily Planet, em comunicado da conta oficial da DeepSeek: a DeepSeek já lançou um modelo de compreensão visual multimodal V4-Flash-Vision-Exp e disponibilizou serviços de API.
Este modelo, baseado na versão V4-Flash, adiciona capacidades de compreensão de imagens e de geração visual, suportando entradas e saídas multimodais como texto e imagens. Além disso, oferece interfaces de chamada para desenvolvedores utilizarem recursos como inferência e geração.
Este modelo, baseado na versão V4-Flash, adiciona capacidades de compreensão de imagens e de geração visual, suportando entradas e saídas multimodais como texto e imagens. Além disso, oferece interfaces de chamada para desenvolvedores utilizarem recursos como inferência e geração.
