Modelos de IA
DeepSeek V4 Flash, rodando no MoClaw
O DeepSeek V4 Flash é o modelo que roda no nível Fast do MoClaw: 1M de contexto, ajustado para agentes, cerca de um terço do preço do V4 Pro. Escolha Fast e comece.
O MoClaw é um computador de IA gerenciado e independente onde você roda modelos de fronteira sem configuração e sem hospedagem própria.
Todas as integraçõesVeja o DeepSeek V4 Flash em ação
Demos da comunidade e trabalho open source sobre o DeepSeek V4 Flash, não saídas do MoClaw.
Um agente de relatório de ações que escreve o próprio .docx
O DeepSeek V4 Flash conduzindo um agente web por 12 passos e 31 chamadas de ferramenta em 11,8 segundos, até um relatório Word pronto, gerado por Python dentro de um sandbox Docker. Exatamente a cadeia longa de ferramentas que o Flash é barato o bastante para repetir.
Rodando o V4 Flash localmente em Metal, CUDA e ROCm
O ds4 é um motor de inferência escrito em C, com licença MIT e 21,4 mil estrelas, para rodar DeepSeek V4 Flash e V4 Pro no seu próprio hardware, com decodificação especulativa DSpark. Também deixa claro quanto trabalho a rota auto-hospedada realmente dá.
Para o que o DeepSeek V4 Flash foi feito
O tipo de trabalho para o qual o DeepSeek V4 Flash foi feito.
O trabalho que você faz cinquenta vezes por dia
Triar, redigir, renomear, reformatar, tirar um número de uma página longa. O Flash é rápido e barato o suficiente para você parar de racionar, e é aí que está a maior parte do valor.
ExperimentarExecução, depois que outro planejou
Um padrão que aparece o tempo todo em fóruns de desenvolvedores: planejar com um modelo pesado e passar as alterações mecânicas para o Flash. Ele marca 82.7 no Terminal Bench 2.1, então se vira bem quando o plano está claro.
ExperimentarEntradas longas sem conta de carro-chefe
O mesmo contexto de um milhão de tokens do V4 Pro, por cerca de um terço do preço e com cinco vezes a concorrência. Transcrições longas, exportações grandes, repositórios inteiros.
ExperimentarTarefas que rodam enquanto você dorme
Agende no computador em nuvem do MoClaw e a máquina fica de pé mesmo com seu notebook desligado. Coletas noturnas, resumos matinais, relatórios semanais.
ExperimentarComo funciona
3 etapas para conectar DeepSeek V4 Flash, sem engenharia.
- 1
Escolha Fast no seletor de modelos
Fast é o DeepSeek V4 Flash. Não há chave para colar nem conta na DeepSeek para criar; o lado do fornecedor fica com o MoClaw.
- 2
Dê uma tarefa, não um prompt
Aqui o Flash roda num computador de verdade, então peça o resultado. Leia estes arquivos, confira aquele site, coloque o resultado numa planilha.
- 3
Suba de nível quando travar
Se uma tarefa precisar de mais raciocínio, troque de nível no meio da conversa. Arquivos, histórico e contexto vão junto.
Por que o DeepSeek V4 Flash é o nível Fast do MoClaw
O que é o DeepSeek V4 Flash?
O DeepSeek V4 Flash é a metade menor e mais rápida da família V4 e chegou ao GA em 31 de julho de 2026 como build DeepSeek-V4-Flash-0731. A DeepSeek manteve a arquitetura e o tamanho da prévia e refez apenas o pós-treinamento, e por isso o salto de capacidade surpreendeu: pelos números da própria DeepSeek, o Flash de GA supera a prévia do V4 Pro nos benchmarks de agente publicados.
Ele traz a mesma janela de contexto de um milhão de tokens e o mesmo teto de 384K de saída do V4 Pro, os mesmos modos com e sem raciocínio, chamadas de ferramentas, saída JSON e os mesmos endpoints compatíveis com OpenAI e Anthropic. Como o resto da família, não tem entrada visual.
Benchmarks do DeepSeek V4 Flash
A DeepSeek publicou Terminal Bench 2.1 em 82.7, DeepSWE em 54.4, NL2Repo em 54.2, CyberGym em 76.7 e Toolathlon-Verified em 70.3. Para um modelo nessa faixa de preço é um conjunto estranho de números, e a reação dos desenvolvedores refletiu isso: no Hacker News, mais de uma pessoa descreveu o Flash 0731 como o maior salto dos dois lançamentos, e o GA do V4 Pro quinze dias depois como o mais discreto.
Tudo isso vem do fornecedor. A DeepSeek ao menos abriu o framework de agente usado nas medições, o DeepSeek Harness, sob MIT como prévia para desenvolvedores, então o andaime é público.
Preços do DeepSeek V4 Flash
Como publicado, o Flash custa US$ 0,14 por milhão de tokens de entrada sem acerto de cache, US$ 0,0028 com acerto e US$ 0,28 por milhão de saída. A partir das 16:00 UTC de 16 de agosto de 2026 a família V4 muda para cobrança de pico e fora de pico: o Flash fica em US$ 0,44 de entrada e US$ 1,32 de saída no pico, e US$ 0,22 e US$ 0,66 fora de pico, com o pico definido das 01:00 às 04:00 e das 06:00 às 10:00 UTC.
O limite de concorrência é de 2.500 contra 500 do V4 Pro, o que pesa mais do que o preço para qualquer coisa em formato de lote.
Rodando o DeepSeek V4 Flash no MoClaw
No MoClaw, o Flash é o nível Fast. Escolha Fast no seletor de modelos e você estará rodando o DeepSeek V4 Flash num computador em nuvem gerenciado: sistema de arquivos persistente, um navegador que mantém a sessão, um shell, agendamento e mais de 50 habilidades já conectadas. Aqui a DeepSeek roda gerenciada pela plataforma, então não há conta a abrir, chave a guardar nem relógio de pico para considerar. Os créditos do plano cobrem.
Trocar é um clique. Comece algo no Fast, decida que precisa de mais profundidade e mova a mesma conversa para um nível mais pesado sem perder arquivos nem histórico. É assim que a maioria trabalha de fato: modelo barato para o volume, modelo caro para a parte difícil.
Onde o Flash deixa de fazer sentido
Não é o modelo para uma tarefa em que errar sai caro e você não vai conferir. Quem usa DeepSeek pesado costuma dizer a mesma coisa: ele vale o preço quando você conduz, e trabalho totalmente autônomo que não dá para verificar eles não entregam a ele. Qualquer coisa baseada em imagem está fora. Para autonomia de longo prazo numa base de código que importa, suba de nível e deixe para o Flash as partes que você confere num relance.
DeepSeek V4 Flash no MoClaw x a API da DeepSeek
Escolha o que combina com seu jeito de usar IA.
| MoClaw (nível Fast) | API DeepSeek direta | |
|---|---|---|
| Configuração | Escolher Fast. É toda a configuração. | Conta, chave de API, saldo pré-pago e seu próprio código cliente. |
| O que ele consegue acessar | Navegador, arquivos, shell, agendamentos e mais de 50 habilidades. | Texto entra, texto sai. As ferramentas você constrói. |
| Cobrança | Créditos do plano, sem tarifas de pico para planejar. | Por token, dividido entre pico e fora de pico desde 16 de agosto. |
| Passar para um modelo mais forte | Troque de nível no meio da conversa, mantendo arquivos e histórico. | Outro fornecedor, outro endpoint, outra fatura. |
Feito para estes workflows
Workflows que as pessoas automatizam com DeepSeek V4 Flash na MoClaw.
Ad Copy Generator
One URL in, ready-to-run ad copy for every platform.
AI Job Description Generator
The whole hiring kit - JD, interview questions, scorecard - in one run.
AI Marketing Strategy Generator
Turn a product, audience, and goal into a marketing strategy doc you can edit and share.
AI Meal Planning Web App Generator
MoClaw builds you a beautiful, ready-to-use meal planning web page with random meal pickers, nutrition info, and calorie-conscious recipes tailored to your diet goals.
AI Pitch Deck Generator
Go from one paragraph to an investor-ready pitch deck.
AI Press Release Generator
A press release that reads your website first.
Integração do DeepSeek V4 Flash para times e fundadores sem tempo
Times que costumam usar o DeepSeek V4 Flash nos fluxos de trabalho do MoClaw.
Solo Founders
SaaS, Shopify/Etsy, bootstrappers
SaaS, Shopify/Etsy, bootstrappers
Professionals
Managers, operators, recruiters, consultants
Managers, operators, recruiters, consultants
Students
College and graduate students
College and graduate students
Marketers
Content, growth, and brand teams
Content, growth, and brand teams
Researchers & Analysts
Academics, market and policy analysts
Academics, market and policy analysts
Educators
Teachers, instructors, curriculum designers
Teachers, instructors, curriculum designers
Product Managers
PMs turning scattered signal into decisions
PMs turning scattered signal into decisions
HR & Recruiting
Recruiters, talent acquisition, people ops
Recruiters, talent acquisition, people ops
Finance & Ops
Finance teams, FinOps, and ops managers
Finance teams, FinOps, and ops managers
Developers & Builders
Indie hackers and agent builders
Indie hackers and agent builders
Sales Teams
SDRs, AEs, and founders who sell
SDRs, AEs, and founders who sell
Customer Support
Support and customer success teams
Support and customer success teams
Combina com
Integrações que costumam ser conectadas junto com DeepSeek V4 Flash.
Claude
Os modelos flagship da Anthropic, incluídos em todos os planos.Claude Fable 5
O modelo mais capaz da Anthropic. Em breve na MoClaw.DeepSeek
Raciocínio de fronteira open-source, via BYOK no OpenRouter.DeepSeek V4 Pro
O carro-chefe agêntico da DeepSeek saiu da prévia em 13 de agosto de 2026.FAQ
Respostas rápidas sobre preço, privacidade e limites.
- O que é o DeepSeek V4 Flash?
- O modelo menor da família V4 da DeepSeek, em GA desde 31 de julho de 2026 como build DeepSeek-V4-Flash-0731. Mantém a janela de contexto de um milhão de tokens e o teto de 384K de saída do V4 Pro, suporta modos com e sem raciocínio e chamadas de ferramentas, e custa cerca de um terço.
- Posso rodar o DeepSeek V4 Flash no MoClaw?
- Sim. O Flash é o modelo por trás do nível Fast do MoClaw. Escolha Fast no seletor e a DeepSeek roda no seu computador em nuvem do MoClaw, com navegador, arquivos, shell e agendamento já conectados. Sem conta na DeepSeek e sem chave de API.
- Quanto custa o DeepSeek V4 Flash?
- Na API da DeepSeek são US$ 0,14 por milhão de tokens de entrada e US$ 0,28 por milhão de saída, passando em 16 de agosto de 2026 para US$ 0,22/US$ 0,66 fora de pico e US$ 0,44/US$ 1,32 no pico. No MoClaw ele roda com créditos do plano, sem medição por token e sem relógio de pico.
- O V4 Flash basta ou devo usar o V4 Pro?
- Para trabalho de volume com um plano claro, o Flash se sustenta: 82.7 no Terminal Bench 2.1 contra os 87.9 do Pro. O Pro abre vantagem nas corridas autônomas longas, sobretudo no DeepSWE, com 62.7 contra 54.4. Um padrão comum é planejar num modelo pesado e executar no Flash.
- O DeepSeek V4 Flash processa imagens?
- Não. A família V4 não tem entrada visual, então capturas de tela e documentos digitalizados exigem outro modelo nessa etapa.
- Preciso de uma chave de API da DeepSeek para o nível Fast?
- Não. A DeepSeek funciona como rota gerenciada pela plataforma dentro do MoClaw. Não há chave para colar, saldo para recarregar nem fatura de fornecedor à parte.
- Qual é a janela de contexto do DeepSeek V4 Flash?
- Um milhão de tokens de entrada e até 384K de saída, igual ao V4 Pro. Transcrições longas, repositórios inteiros e exportações grandes cabem numa passada só.
- Posso sair do Flash no meio da conversa?
- Sim. Mova a conversa para um nível mais forte quando a tarefa exigir mais raciocínio; seus arquivos, histórico e contexto acompanham. A maioria roda barato no volume e sobe na parte difícil.
Leitura relacionada
Guias que se aprofundam em DeepSeek V4 Flash e na automação com IA.
What Is DeepSeek Harness (DSH)?
DeepSeek Harness (DSH) is DeepSeek's open-source, plugin-first agent runtime. What it is, why it ships with no CLI, and whether it's usable yet.
Why DeepSeek V4 Pro Is a Game-Changer for AI Agents
DeepSeek V4 Pro hits Opus-class quality at 1/30 the price. Why MoClaw shipped it day one, the benchmarks, the limits, and 1 month free for users.
AI Agent Orchestration: Design Guide
AI agent orchestration coordinates agents, tools, evidence, and people toward one outcome. Learn when it helps, how to set boundaries, and when you overbuild.