Modelos de IA

DeepSeek V4 Flash, funcionando en MoClaw

DeepSeek V4 Flash es el modelo que ejecuta el nivel Fast de MoClaw: 1M de contexto, afinado para agentes, un tercio del precio de V4 Pro. Elige Fast y escribe la tarea.

DeepSeek V4 Flash

MoClaw es un ordenador de IA gestionado e independiente en el que puedes ejecutar modelos de frontera sin configuración ni alojamiento propio.

Todas las integraciones

Ve DeepSeek V4 Flash en acción

Demos de la comunidad y proyectos de código abierto sobre DeepSeek V4 Flash, no salidas de MoClaw.

Demo de DeepSeek V4 Flash — Un agente de informes bursátiles que escribe su propio .docx, creada por @farhanhelmycode

Un agente de informes bursátiles que escribe su propio .docx

DeepSeek V4 Flash moviendo un agente web por 12 pasos y 31 llamadas a herramientas en 11,8 segundos, hasta un informe de Word terminado que Python genera dentro de un sandbox Docker. Justo la cadena larga de herramientas que Flash es lo bastante barato para repetir.

Demo de @farhanhelmycode Abrir
Demo de DeepSeek V4 Flash — Ejecutar V4 Flash en local sobre Metal, CUDA y ROCm, creada por antirez

Ejecutar V4 Flash en local sobre Metal, CUDA y ROCm

ds4 es un motor de inferencia escrito en C, con licencia MIT y 21,4k estrellas, para ejecutar DeepSeek V4 Flash y V4 Pro en tu propio hardware, con decodificación especulativa DSpark. También deja claro cuánto trabajo supone realmente la vía del autoalojamiento.

Open source · antirez/ds4 Abrir

Cómo funciona

3 pasos para conectar DeepSeek V4 Flash, sin ingeniería.

  1. 1

    Elige Fast en el selector de modelos

    Fast es DeepSeek V4 Flash. No hay clave que pegar ni cuenta de DeepSeek que crear; MoClaw se ocupa del lado del proveedor.

  2. 2

    Dale una tarea, no un prompt

    Aquí Flash corre sobre un ordenador real, así que pide el resultado. Lee estos archivos, mira ese sitio, deja el resultado en una hoja de cálculo.

  3. 3

    Sube de nivel cuando se atasque

    Si una tarea necesita más razonamiento, cambia de nivel a mitad de hilo. Archivos, historial y contexto se mantienen.

Por qué DeepSeek V4 Flash es el nivel Fast de MoClaw

¿Qué es DeepSeek V4 Flash?

DeepSeek V4 Flash es la mitad pequeña y rápida de la familia V4, y llegó a GA el 31 de julio de 2026 como build DeepSeek-V4-Flash-0731. DeepSeek mantuvo la arquitectura y el tamaño de la preview y volvió a hacer el post-entrenamiento, y por eso el salto de capacidad sorprendió: según las propias cifras de DeepSeek, el Flash de GA supera a la preview de V4 Pro en los benchmarks de agentes publicados.

Lleva la misma ventana de contexto de un millón de tokens y el mismo techo de 384K de salida que V4 Pro, los mismos modos con y sin razonamiento, llamadas a herramientas, salida JSON y los mismos endpoints compatibles con OpenAI y Anthropic. Como el resto de la familia, no tiene entrada visual.

Benchmarks de DeepSeek V4 Flash

DeepSeek publicó Terminal Bench 2.1 en 82.7, DeepSWE en 54.4, NL2Repo en 54.2, CyberGym en 76.7 y Toolathlon-Verified en 70.3. Para un modelo a este precio es un conjunto de números raro de mirar, y la reacción de los desarrolladores lo reflejó: en Hacker News más de uno describió Flash 0731 como el mayor salto de los dos lanzamientos, y el GA de V4 Pro quince días después como el más discreto.

Todo ello son datos del fabricante. DeepSeek sí liberó el framework de agentes con el que midió, DeepSeek Harness, bajo MIT como versión preliminar para desarrolladores, así que el andamiaje al menos es público.

Precios de DeepSeek V4 Flash

Según lo publicado, Flash cuesta 0,14 $ por millón de tokens de entrada sin acierto de caché, 0,0028 $ con acierto y 0,28 $ por millón de salida. Desde las 16:00 UTC del 16 de agosto de 2026 la familia V4 pasa a facturación pico y valle: Flash queda en 0,44 $ de entrada y 1,32 $ de salida en pico, y 0,22 $ y 0,66 $ en valle, con el pico definido de 01:00 a 04:00 y de 06:00 a 10:00 UTC.

El límite de concurrencia es de 2.500 frente a los 500 de V4 Pro, y eso importa más que el precio para cualquier cosa con forma de lote.

Ejecutar DeepSeek V4 Flash en MoClaw

En MoClaw, Flash es el nivel Fast. Elige Fast en el selector de modelos y estarás ejecutando DeepSeek V4 Flash en un ordenador en la nube gestionado: sistema de archivos persistente, un navegador que conserva la sesión, una shell, programación de tareas y más de 50 habilidades ya conectadas. Aquí DeepSeek corre gestionado por la plataforma, así que no hay cuenta de DeepSeek que abrir, ni clave que guardar, ni reloj de horas pico sobre el que razonar. Los créditos del plan lo cubren.

Cambiar es un clic. Empieza algo en Fast, decide que necesita más profundidad y mueve el mismo hilo a un nivel más pesado sin perder archivos ni historial. Así trabaja de verdad casi todo el mundo: modelo barato para el volumen, modelo caro para la parte difícil.

Dónde deja Flash de tener sentido

No es el modelo para una tarea donde equivocarse sale caro y no vas a revisarlo. Quienes usan DeepSeek de forma intensiva suelen decir lo mismo: se gana su precio cuando lo guías, y no le entregan trabajo totalmente autónomo que no puedan verificar. Todo lo que parta de una imagen queda descartado. Para autonomía de largo recorrido sobre una base de código que te importa, sube de nivel y deja a Flash las partes que puedas comprobar de un vistazo.

DeepSeek V4 Flash en MoClaw frente a la API de DeepSeek

Elige lo que encaje con tu forma de usar IA.

MoClaw (nivel Fast) API de DeepSeek directa
Configuración Elegir Fast. Esa es toda la configuración. Cuenta, clave de API, saldo prepago y tu propio código cliente.
Qué puede tocar Navegador, archivos, shell, programaciones y más de 50 habilidades. Texto de entrada, texto de salida. Las herramientas las construyes tú.
Facturación Créditos del plan, sin tarifas pico que planificar. Por token, dividido en pico y valle desde el 16 de agosto.
Pasar a un modelo más potente Cambia de nivel a mitad de hilo y conserva archivos e historial. Otro proveedor, otro endpoint, otra factura.

FAQ

Respuestas rápidas sobre precios, privacidad y límites.

¿Qué es DeepSeek V4 Flash?
El modelo pequeño de la familia V4 de DeepSeek, en GA desde el 31 de julio de 2026 como build DeepSeek-V4-Flash-0731. Conserva la ventana de contexto de un millón de tokens y el techo de 384K de salida de V4 Pro, admite modos con y sin razonamiento y llamadas a herramientas, y cuesta alrededor de un tercio.
¿Puedo ejecutar DeepSeek V4 Flash en MoClaw?
Sí. Flash es el modelo tras el nivel Fast de MoClaw. Elige Fast en el selector y DeepSeek corre en tu ordenador en la nube de MoClaw con navegador, archivos, shell y programación ya conectados. Sin cuenta de DeepSeek y sin clave de API.
¿Cuánto cuesta DeepSeek V4 Flash?
En la API de DeepSeek son 0,14 $ por millón de tokens de entrada y 0,28 $ por millón de salida, que el 16 de agosto de 2026 pasan a 0,22 $/0,66 $ en valle y 0,44 $/1,32 $ en pico. En MoClaw funciona con créditos del plan, sin medición por token ni reloj de horas pico.
¿Basta con V4 Flash o debería usar V4 Pro?
Para trabajo de volumen con un plan claro, Flash aguanta: 82.7 en Terminal Bench 2.1 frente al 87.9 de Pro. Pro se despega en recorridos autónomos largos, sobre todo en DeepSWE, con 62.7 frente a 54.4. Un patrón habitual es planificar en un modelo pesado y ejecutar en Flash.
¿DeepSeek V4 Flash procesa imágenes?
No. La familia V4 no tiene entrada visual, así que capturas y documentos escaneados necesitan otro modelo para ese paso.
¿Necesito una clave de API de DeepSeek para el nivel Fast?
No. DeepSeek funciona como ruta gestionada por la plataforma dentro de MoClaw. No hay clave que pegar, ni saldo que recargar, ni factura de proveedor aparte.
¿Cuál es la ventana de contexto de DeepSeek V4 Flash?
Un millón de tokens de entrada y hasta 384K de salida, igual que V4 Pro. Transcripciones largas, repositorios completos y exportaciones grandes caben en una sola pasada.
¿Puedo salir de Flash a mitad de conversación?
Sí. Mueve el hilo a un nivel más potente cuando una tarea necesite más razonamiento; tus archivos, historial y contexto te siguen. La mayoría va barato para el volumen y sube para la parte difícil.

Prueba MoClaw gratis.

Empieza gratis con 1.000 credits.

Cancela cuando quieras