Título original: (DeepSeek V4 Pro versão oficial é lançado)
Autor original: Observação Beating
O DeepSeek V4 Pro versão oficial chegou.
Na noite de 12 de agosto, a documentação oficial da API da DeepSeek atualizou a versão do modelo correspondente ao deepseek-v4-pro para DeepSeek-V4-Pro-0813. Atualmente, os desenvolvedores podem chamar diretamente a nova versão via API; o preço é de 3 ienes por milhão de tokens de entrada e 6 ienes por milhão de tokens de saída, com entrada em cache equivalente a apenas 0,025 ienes por milhão de tokens.
O V4 Pro-0813 continua oferecendo uma janela de contexto de até 1 milhão de tokens, com saída máxima de 384 mil tokens; além disso, suporta dois modos: pensamento (thinking) e não pensamento (non-thinking). Recursos como JSON Output e Tool Calls também já foram liberados.
Até o fim da noite de 12 de agosto, o registro de atualização oficial do DeepSeek ainda não havia publicado separadamente um anúncio do V4 Pro em versão oficial. Mas, na atualização anterior do V4 Flash em versão oficial, o DeepSeek já havia deixado claro que o V4 Pro em versão oficial seria lançado posteriormente. Hoje, os nós de modelo no back-end da API já foram trocados da versão anterior para o DeepSeek-V4-Pro-0813.
Já se passaram quase quatro meses desde a primeira aparição do V4.
No dia 24 de abril deste ano, o DeepSeek lançou o V4 Preview, juntamente com o V4 Pro e o V4 Flash. O V4 Pro é a versão flagship de toda a linha, com quantidade total de parâmetros de 1,6T; cerca de 49B de parâmetros são ativados por token, e ele suporta contexto de 1 milhão de tokens. Desde o início, esta geração do V4 já reforçou claramente Coding, chamadas de ferramentas e tarefas de agentes de longa duração.
31 de julho, o DeepSeek lançou o V4-Flash-0731. A empresa informou que esta versão mantém a arquitetura e o tamanho do modelo originais, com foco principalmente em um novo pós-treinamento. As capacidades de agentes foram significativamente aprimoradas, e a API de Responses foi integrada nativamente. Além disso, houve adaptação para o Codex. Na época, o DeepSeek também enfatizou que esta atualização se limitava ao Flash; não houve mudanças nos modelos Pro e da versão para web. O V4 Pro em versão oficial foi lançado posteriormente.
Agora, o último quebra-cabeça do Pro finalmente foi completado.

Esta geração de modelos do DeepSeek está cada vez mais voltada para agentes
O momento de lançamento do V4 Pro em versão oficial coincidiu perfeitamente com a transferência do foco de produtos de toda a indústria de grandes modelos para uma nova rodada.
Quando fabricantes de modelos lançam novidades este ano, a quantidade de conteúdo comparando apenas perguntas e respostas de conhecimento, matemática e benchmarks tradicionais vem ficando cada vez menor. Coding, Computer Use, Tool Use, a taxa de conclusão de tarefas de longa duração e, principalmente, quanto custa concluir uma tarefa de fato estão se tornando os novos indicadores centrais.
Em julho, quando lançou o GPT-5.6, a OpenAI gastou bastante espaço para apresentar as capacidades de agentes e de programação (Coding). O GPT-5.6 Sol oferece um novo max reasoning effort e traz ainda o modo ultra, no qual vários agentes executam tarefas complexas em paralelo. A API de Responses também começou a permitir que o modelo escreva diretamente programas para coordenar ferramentas, processe resultados intermediários e, então, decida o próximo passo. A OpenAI chegou até a colocar “quanto trabalho pode ser concluído por cada dólar” como um dos principais argumentos de venda desta geração.
A rota da Anthropic também é muito próxima.
O Claude Sonnet 5, lançado no fim de junho, teve melhorias principalmente concentradas em Coding, agentes, Computer Use e tarefas de longa duração. A Anthropic oferece diferentes níveis de esforço para que os desenvolvedores escolham a intensidade de raciocínio conforme a tarefa; em 10 de agosto, a Anthropic também anunciou que o preço promocional original do Sonnet 5 (2 dólares por milhão de entradas e 10 dólares por milhão de saídas) seria mantido permanentemente.
As empresas de modelos agora enfrentam algo que não é apenas “quem é mais inteligente”.
Um agente pode executar continuamente por dezenas de minutos ou até horas, lendo e reescrevendo código repetidamente, buscando informações, chamando o navegador e ferramentas externas. Assim que entra de fato no ambiente de produção, o número de chamadas do modelo aumenta rapidamente. Capacidade, velocidade, consumo de tokens e preço das chamadas passam a determinar, em conjunto, se um produto de agente consegue “rodar”.
O design do DeepSeek V4 também se desenvolve basicamente nessa direção.
Um contexto de 1 milhão de tokens permite que o modelo leia de uma vez repositórios de código maiores, bases de conhecimento corporativas e históricos de tarefas; as Tool Calls são responsáveis por interagir com ambientes externos; e a compatibilidade com a API da Anthropic, além da API de Responses que o Flash já suportava, reduz o limite para o modelo entrar nas cadeias de ferramentas existentes de agentes. Quando o DeepSeek lançou o V4 em abril, ele já havia aberto simultaneamente as interfaces OpenAI ChatCompletions e formatos da Anthropic.
Esse também é o ponto que torna o V4 Pro em versão oficial mais digno de atenção do que um DeepSeek “simplesmente mais um” modelo. O DeepSeek está transformando o modelo em uma infraestrutura básica que pode ser chamada diretamente por agentes.
Após o lançamento do V4 Pro em versão oficial, a divisão em camadas da linha de produtos do DeepSeek ficou ainda mais clara.
Atualmente, o preço de entrada do V4 Flash é 1 yuan por milhão de tokens, e o do Pro é 3 yuan; a saída do Flash é 2 yuan, e a do Pro é 6 yuan. As duas tarifas diferem exatamente em três vezes. O V4 Pro e o Flash suportam contexto de até 1 milhão de tokens, mas o Pro usa uma escala maior de parâmetros de ativação, posicionando-se mais para raciocínio complexo, Coding e tarefas de agentes ainda mais difíceis.
O Flash assume muitas tarefas, de alta frequência e sensíveis a custo; o Pro fica com trabalhos mais pesados.
A competição entre modelos de grande porte em 2025 ainda gira frequentemente em torno de “qual modelo de ponta tem as melhores pontuações”. Em 2026, os modelos estão se tornando cada vez mais uma infraestrutura real de software: não apenas inteligentes, mas também com API estável, contexto longo, uso de ferramentas, concorrência suficientemente alta e preços que os desenvolvedores consigam justificar.
Depois que o V4 Pro em versão oficial entrou no ar, o contorno do produto da geração DeepSeek V4 finalmente ficou completo.
Link original
