Modelos de IA

DeepSeek V4 Flash, rodando no MoClaw

O DeepSeek V4 Flash é o modelo que roda no nível Fast do MoClaw: 1M de contexto, ajustado para agentes, cerca de um terço do preço do V4 Pro. Escolha Fast e comece.

DeepSeek V4 Flash

O MoClaw é um computador de IA gerenciado e independente onde você roda modelos de fronteira sem configuração e sem hospedagem própria.

Todas as integrações

Veja o DeepSeek V4 Flash em ação

Demos da comunidade e trabalho open source sobre o DeepSeek V4 Flash, não saídas do MoClaw.

Demo do DeepSeek V4 Flash — Um agente de relatório de ações que escreve o próprio .docx, criada por @farhanhelmycode

Um agente de relatório de ações que escreve o próprio .docx

O DeepSeek V4 Flash conduzindo um agente web por 12 passos e 31 chamadas de ferramenta em 11,8 segundos, até um relatório Word pronto, gerado por Python dentro de um sandbox Docker. Exatamente a cadeia longa de ferramentas que o Flash é barato o bastante para repetir.

Demo por @farhanhelmycode Abrir
Demo do DeepSeek V4 Flash — Rodando o V4 Flash localmente em Metal, CUDA e ROCm, criada por antirez

Rodando o V4 Flash localmente em Metal, CUDA e ROCm

O ds4 é um motor de inferência escrito em C, com licença MIT e 21,4 mil estrelas, para rodar DeepSeek V4 Flash e V4 Pro no seu próprio hardware, com decodificação especulativa DSpark. Também deixa claro quanto trabalho a rota auto-hospedada realmente dá.

Open source · antirez/ds4 Abrir

Como funciona

3 etapas para conectar DeepSeek V4 Flash, sem engenharia.

  1. 1

    Escolha Fast no seletor de modelos

    Fast é o DeepSeek V4 Flash. Não há chave para colar nem conta na DeepSeek para criar; o lado do fornecedor fica com o MoClaw.

  2. 2

    Dê uma tarefa, não um prompt

    Aqui o Flash roda num computador de verdade, então peça o resultado. Leia estes arquivos, confira aquele site, coloque o resultado numa planilha.

  3. 3

    Suba de nível quando travar

    Se uma tarefa precisar de mais raciocínio, troque de nível no meio da conversa. Arquivos, histórico e contexto vão junto.

Por que o DeepSeek V4 Flash é o nível Fast do MoClaw

O que é o DeepSeek V4 Flash?

O DeepSeek V4 Flash é a metade menor e mais rápida da família V4 e chegou ao GA em 31 de julho de 2026 como build DeepSeek-V4-Flash-0731. A DeepSeek manteve a arquitetura e o tamanho da prévia e refez apenas o pós-treinamento, e por isso o salto de capacidade surpreendeu: pelos números da própria DeepSeek, o Flash de GA supera a prévia do V4 Pro nos benchmarks de agente publicados.

Ele traz a mesma janela de contexto de um milhão de tokens e o mesmo teto de 384K de saída do V4 Pro, os mesmos modos com e sem raciocínio, chamadas de ferramentas, saída JSON e os mesmos endpoints compatíveis com OpenAI e Anthropic. Como o resto da família, não tem entrada visual.

Benchmarks do DeepSeek V4 Flash

A DeepSeek publicou Terminal Bench 2.1 em 82.7, DeepSWE em 54.4, NL2Repo em 54.2, CyberGym em 76.7 e Toolathlon-Verified em 70.3. Para um modelo nessa faixa de preço é um conjunto estranho de números, e a reação dos desenvolvedores refletiu isso: no Hacker News, mais de uma pessoa descreveu o Flash 0731 como o maior salto dos dois lançamentos, e o GA do V4 Pro quinze dias depois como o mais discreto.

Tudo isso vem do fornecedor. A DeepSeek ao menos abriu o framework de agente usado nas medições, o DeepSeek Harness, sob MIT como prévia para desenvolvedores, então o andaime é público.

Preços do DeepSeek V4 Flash

Como publicado, o Flash custa US$ 0,14 por milhão de tokens de entrada sem acerto de cache, US$ 0,0028 com acerto e US$ 0,28 por milhão de saída. A partir das 16:00 UTC de 16 de agosto de 2026 a família V4 muda para cobrança de pico e fora de pico: o Flash fica em US$ 0,44 de entrada e US$ 1,32 de saída no pico, e US$ 0,22 e US$ 0,66 fora de pico, com o pico definido das 01:00 às 04:00 e das 06:00 às 10:00 UTC.

O limite de concorrência é de 2.500 contra 500 do V4 Pro, o que pesa mais do que o preço para qualquer coisa em formato de lote.

Rodando o DeepSeek V4 Flash no MoClaw

No MoClaw, o Flash é o nível Fast. Escolha Fast no seletor de modelos e você estará rodando o DeepSeek V4 Flash num computador em nuvem gerenciado: sistema de arquivos persistente, um navegador que mantém a sessão, um shell, agendamento e mais de 50 habilidades já conectadas. Aqui a DeepSeek roda gerenciada pela plataforma, então não há conta a abrir, chave a guardar nem relógio de pico para considerar. Os créditos do plano cobrem.

Trocar é um clique. Comece algo no Fast, decida que precisa de mais profundidade e mova a mesma conversa para um nível mais pesado sem perder arquivos nem histórico. É assim que a maioria trabalha de fato: modelo barato para o volume, modelo caro para a parte difícil.

Onde o Flash deixa de fazer sentido

Não é o modelo para uma tarefa em que errar sai caro e você não vai conferir. Quem usa DeepSeek pesado costuma dizer a mesma coisa: ele vale o preço quando você conduz, e trabalho totalmente autônomo que não dá para verificar eles não entregam a ele. Qualquer coisa baseada em imagem está fora. Para autonomia de longo prazo numa base de código que importa, suba de nível e deixe para o Flash as partes que você confere num relance.

DeepSeek V4 Flash no MoClaw x a API da DeepSeek

Escolha o que combina com seu jeito de usar IA.

MoClaw (nível Fast) API DeepSeek direta
Configuração Escolher Fast. É toda a configuração. Conta, chave de API, saldo pré-pago e seu próprio código cliente.
O que ele consegue acessar Navegador, arquivos, shell, agendamentos e mais de 50 habilidades. Texto entra, texto sai. As ferramentas você constrói.
Cobrança Créditos do plano, sem tarifas de pico para planejar. Por token, dividido entre pico e fora de pico desde 16 de agosto.
Passar para um modelo mais forte Troque de nível no meio da conversa, mantendo arquivos e histórico. Outro fornecedor, outro endpoint, outra fatura.

FAQ

Respostas rápidas sobre preço, privacidade e limites.

O que é o DeepSeek V4 Flash?
O modelo menor da família V4 da DeepSeek, em GA desde 31 de julho de 2026 como build DeepSeek-V4-Flash-0731. Mantém a janela de contexto de um milhão de tokens e o teto de 384K de saída do V4 Pro, suporta modos com e sem raciocínio e chamadas de ferramentas, e custa cerca de um terço.
Posso rodar o DeepSeek V4 Flash no MoClaw?
Sim. O Flash é o modelo por trás do nível Fast do MoClaw. Escolha Fast no seletor e a DeepSeek roda no seu computador em nuvem do MoClaw, com navegador, arquivos, shell e agendamento já conectados. Sem conta na DeepSeek e sem chave de API.
Quanto custa o DeepSeek V4 Flash?
Na API da DeepSeek são US$ 0,14 por milhão de tokens de entrada e US$ 0,28 por milhão de saída, passando em 16 de agosto de 2026 para US$ 0,22/US$ 0,66 fora de pico e US$ 0,44/US$ 1,32 no pico. No MoClaw ele roda com créditos do plano, sem medição por token e sem relógio de pico.
O V4 Flash basta ou devo usar o V4 Pro?
Para trabalho de volume com um plano claro, o Flash se sustenta: 82.7 no Terminal Bench 2.1 contra os 87.9 do Pro. O Pro abre vantagem nas corridas autônomas longas, sobretudo no DeepSWE, com 62.7 contra 54.4. Um padrão comum é planejar num modelo pesado e executar no Flash.
O DeepSeek V4 Flash processa imagens?
Não. A família V4 não tem entrada visual, então capturas de tela e documentos digitalizados exigem outro modelo nessa etapa.
Preciso de uma chave de API da DeepSeek para o nível Fast?
Não. A DeepSeek funciona como rota gerenciada pela plataforma dentro do MoClaw. Não há chave para colar, saldo para recarregar nem fatura de fornecedor à parte.
Qual é a janela de contexto do DeepSeek V4 Flash?
Um milhão de tokens de entrada e até 384K de saída, igual ao V4 Pro. Transcrições longas, repositórios inteiros e exportações grandes cabem numa passada só.
Posso sair do Flash no meio da conversa?
Sim. Mova a conversa para um nível mais forte quando a tarefa exigir mais raciocínio; seus arquivos, histórico e contexto acompanham. A maioria roda barato no volume e sobe na parte difícil.

Teste a MoClaw grátis.

Comece grátis com 1.000 credits.

Cancele quando quiser