← Todos os modelos

DeepSeek V4 Flash: referência histórica do modelo

1M tokens · Text / Code · Prompt cache

DeepSeek V4 Flash não é mais oferecido na Okou. Consulte GPT 6 Luna como alternativa atualmente suportada. Esta página preserva informações históricas, não os preços atuais da Okou.

Ver GPT 6 Luna

O que é o DeepSeek V4 Flash?

31 de julho de 2026 (DeepSeek-V4-Flash-0731, beta pública)

O que se destaca no DeepSeek V4 Flash

Principais recursos de arquitetura e capacidade.

O V4 Flash é um modelo Mixture-of-Experts esparso: 284 bilhões de parâmetros no total, com 13 bilhões ativados por token, em que cada camada MoE tem 1 especialista compartilhado e 256 especialistas roteados com dimensão intermediária de 2048, e 6 especialistas roteados são acionados por token. As três primeiras camadas MoE usam roteamento por hash e a profundidade de predição multi-token é 1. O checkpoint 0731 publicado chega a 304 bilhões de parâmetros porque traz um módulo de rascunho para decodificação especulativa sobre a base de 284 bilhões. Suporta janela de contexto de um milhão de tokens com até 384 K de saída, modos com e sem raciocínio e um parâmetro reasoning_effort com os níveis low, high e max. Os pesos estão sob licença MIT e sem restrição de acesso.

Especificações em resumo

FornecedorDeepSeek
ID do modelodeepseek-v4-flash
ModalidadesText, Code

Benchmarks do DeepSeek V4 Flash

Números reportados pela DeepSeek no cartão do modelo DeepSeek-V4-Flash-0731, obtidos com o DeepSeek Harness em modo minimal e esforço de raciocínio máximo (temperatura 1,0, top_p 0,95). O harness não foi publicado, então nenhum desses resultados foi reproduzido de forma independente; DSBench-FullStack e DSBench-Hard são conjuntos de teste internos da DeepSeek.

Terminal-Bench 2.1trabalho agêntico em terminal; V4 Pro (Preview) 72,1
82,7
SWE-bench Verifiedbuild de preview, dado do fornecedor
79,0%
Cybergymdado do fornecedor
76,7
Toolathlon (verified)uso de ferramentas; V4 Pro (Preview) 55,9
70,3
DSBench-FullStackconjunto interno da DeepSeek
68,7
DSBench-Hardconjunto interno da DeepSeek
59,6
DeepSWEante 7,3 na build de preview
54,4
NL2Repoconstrução de repositórios
54,2
Agents' Last Examo Claude Opus 4.8 faz 25,7
25,2

Melhores tarefas de agente para o DeepSeek V4 Flash

Automação por terminal e ferramentas

Os melhores resultados publicados da build 0731 são em trabalho de terminal e uso de ferramentas — exatamente o que um agente de correção de build, verificação de deploy ou triagem de logs faz o dia inteiro.

Leitura do repositório inteiro

Uma janela de um milhão de tokens comporta um repositório de porte médio completo, uma longa linha do tempo de incidente ou um conjunto inteiro de documentos de projeto em uma única passagem, permitindo que um agente de migração ou auditoria raciocine sobre o todo em vez de pedaço por pedaço.

A camada barata sob um orquestrador de fronteira

Deixe Claude Opus 5 ou GPT 5.6 Sol planejar e revisar e entregue ao V4 Flash as muitas etapas mecânicas: ler arquivos, rodar comandos, rascunhar patches. Você paga a tarifa de fronteira só nas etapas que decidem a execução.

Perguntas frequentes

Qual é a janela de contexto do DeepSeek V4 Flash?

Um milhão de tokens de entrada e até 384 K tokens de saída por resposta. A DeepSeek recomenda o teto completo de 384 K de saída nos níveis de esforço high e max.

O DeepSeek V4 Flash tem suporte a visão?

Não. Ele aceita apenas texto e código. Direcione etapas baseadas em capturas de tela, gráficos ou PDFs para um modelo multimodal como Claude Sonnet 4.6 ou GPT 5.6 Luna.

Alternativas

Disponibilidade do DeepSeek V4 Flash na Okou

DeepSeek V4 Flash não é mais oferecido na Okou. Consulte GPT 6 Luna como alternativa atualmente suportada. Esta página preserva informações históricas, não os preços atuais da Okou.