O DeepSeek-V4-Flash — a nova versão do modelo leve e rápido — já está disponível em beta pública por meio da API. Esta atualização está longe de ser apenas mais uma. O principal foco deste lançamento é o reforço das capacidades de agentes de IA.

Agora o modelo consegue atuar como um engenheiro: abrir o terminal, analisar repositórios, utilizar ferramentas e executar tarefas complexas com várias etapas. O DeepSeek-V4-Flash torna-se um assistente de IA completo para desenvolvedores e agentes autónomos.

O que há de novo em números?

Resultados nos benchmarks:
- Terminal Bench 2.1 (trabalho no terminal): 82.7
- Cybergym (cibersegurança): 76.7
- Toolathlon Verified (utilização de ferramentas): 70.3
- DSBench-FullStack (desenvolvimento completo): 68.7


Detalhes técnicos

Estrutura: a arquitetura e o tamanho permanecem inalterados (13 mil milhões de parâmetros ativos), mas o modelo passou por um processo completo de pós-treinamento (post-training).

Onde funciona: a atualização aplica-se apenas à versão API do deepseek-v4-flash. O modelo disponível no site (WEB) e na aplicação (APP) permanece inalterado.

Integração: o modelo suporta o formato Responses API e foi otimizado para funcionar com o Codex.

O que vem a seguir: o lançamento da versão completa do DeepSeek-V4-Pro é esperado para breve.


Critério Preview (abril de 2026) Lançamento oficial (31 de julho de 2026)
Foco principal Desempenho básico Capacidades de agentes, ferramentas
Terminal Bench 61.8 82.7
Toolathlon 49.7 70.3
Tarefas de agentes Atrás da versão Pro Aproximou-se do V4-Pro
Arquitetura MoE, 13B ativos MoE, 13B ativos (sem alterações)
Suporte ao Codex Não disponível Disponível
Formato da API ChatCompletions + Responses API

Fonte: deepseek.com