KI-Modelle

DeepSeek V4 Flash, läuft in MoClaw

DeepSeek V4 Flash ist das Modell hinter MoClaws Fast-Stufe: 1M Kontext, auf Agenten trainiert, rund ein Drittel des V4-Pro-Preises. Fast wählen, Aufgabe tippen, los.

DeepSeek V4 Flash

MoClaw ist ein unabhängiger verwalteter KI-Computer, auf dem du Frontier-Modelle ohne Einrichtung und ohne Self-Hosting ausführen kannst.

Alle Integrationen

DeepSeek V4 Flash in Aktion

Community-Demos und Open-Source-Arbeit auf Basis von DeepSeek V4 Flash, nicht von MoClaw erzeugt.

DeepSeek V4 Flash-Demo — Ein Aktienreport-Agent, der sein .docx selbst schreibt, erstellt von @farhanhelmycode

Ein Aktienreport-Agent, der sein .docx selbst schreibt

DeepSeek V4 Flash treibt einen Web-Agenten durch 12 Schritte und 31 Tool-Aufrufe in 11,8 Sekunden, am Ende steht ein fertiger Word-Bericht, den Python in einer Docker-Sandbox erzeugt hat. Genau die lange Werkzeugkette, die mit Flash billig genug ist, um sie ständig laufen zu lassen.

Demo von @farhanhelmycode Öffnen
DeepSeek V4 Flash-Demo — V4 Flash lokal auf Metal, CUDA und ROCm, erstellt von antirez

V4 Flash lokal auf Metal, CUDA und ROCm

ds4 ist eine MIT-lizenzierte Inferenz-Engine in C mit 21,4k Sternen, um DeepSeek V4 Flash und V4 Pro auf eigener Hardware zu betreiben, samt DSpark Speculative Decoding. Auch ein Beleg dafür, wie viel Arbeit der Selbsthosting-Weg tatsächlich ist.

Open source · antirez/ds4 Öffnen

So funktioniert es

3 Schritte, um DeepSeek V4 Flash einzubinden — ohne Engineering-Aufwand.

  1. 1

    Fast in der Modellauswahl wählen

    Fast ist DeepSeek V4 Flash. Kein Key zum Einfügen und kein DeepSeek-Konto anzulegen; die Anbieterseite übernimmt MoClaw.

  2. 2

    Gib ihm eine Aufgabe, keinen Prompt

    Flash läuft hier auf einem echten Computer, frag also nach dem Ergebnis. Lies diese Dateien, prüf jene Website, schreib das Ergebnis in eine Tabelle.

  3. 3

    Eine Stufe höher, wenn es hakt

    Braucht eine Aufgabe mehr Denkleistung, wechsle mitten im Thread die Stufe. Dateien, Verlauf und Kontext kommen mit.

Warum DeepSeek V4 Flash MoClaws Fast-Stufe ist

Was ist DeepSeek V4 Flash?

DeepSeek V4 Flash ist die kleinere, schnellere Hälfte der V4-Familie und wurde am 31. Juli 2026 allgemein verfügbar als Build DeepSeek-V4-Flash-0731. DeepSeek behielt Architektur und Größe der Preview bei und ließ nur das Post-Training neu laufen, weshalb der Fähigkeitssprung überraschte: Nach DeepSeeks eigenen Zahlen schlägt das GA-Flash die Preview von V4 Pro über die veröffentlichten Agenten-Benchmarks hinweg.

Es trägt dasselbe Kontextfenster von einer Million Token und dieselbe Obergrenze von 384K Ausgabetoken wie V4 Pro, dazu Denk- und Nicht-Denkmodus, Tool-Calls, JSON-Ausgabe und dieselben OpenAI- und Anthropic-kompatiblen Endpunkte. Wie der Rest der Familie hat es keine Bildeingabe.

DeepSeek V4 Flash Benchmarks

DeepSeek nennt Terminal Bench 2.1 mit 82.7, DeepSWE mit 54.4, NL2Repo mit 54.2, CyberGym mit 76.7 und Toolathlon-Verified mit 70.3. Für ein Modell dieser Preisklasse ist das ein merkwürdiger Satz Zahlen, und die Reaktion der Entwickler spiegelte das: Auf Hacker News beschrieb mehr als eine Person Flash 0731 als den größeren Sprung der beiden Releases und das GA von V4 Pro zwei Wochen später als das leisere.

Alles davon sind Herstellerangaben. Immerhin hat DeepSeek das benutzte Agenten-Framework DeepSeek Harness unter MIT als Developer Preview quelloffen gestellt, das Gerüst ist also öffentlich.

Preise für DeepSeek V4 Flash

Wie veröffentlicht kostet Flash 0,14 $ je Million Eingabetoken bei Cache-Miss, 0,0028 $ bei Cache-Hit und 0,28 $ je Million Ausgabe. Ab 16:00 UTC am 16. August 2026 wechselt die V4-Familie auf Peak- und Off-Peak-Abrechnung: Flash liegt dann im Peak bei 0,44 $ Eingabe und 1,32 $ Ausgabe, off-peak bei 0,22 $ und 0,66 $, wobei Peak von 01:00 bis 04:00 und 06:00 bis 10:00 UTC definiert ist.

Das Parallelitätslimit liegt bei 2.500 gegenüber 500 bei V4 Pro, was für alles Batch-Förmige mehr zählt als der Preis.

DeepSeek V4 Flash auf MoClaw betreiben

Auf MoClaw ist Flash die Fast-Stufe. Wähle Fast in der Modellauswahl, und du betreibst DeepSeek V4 Flash auf einem verwalteten Cloud-Computer: dauerhaftes Dateisystem, ein Browser, der seine Sitzung behält, eine Shell, Zeitplanung und über 50 bereits angebundene Skills. DeepSeek läuft hier plattformverwaltet, es gibt also kein DeepSeek-Konto zu eröffnen, keinen Key zu speichern und keine Peak-Uhr mitzudenken. Plan-Credits decken das ab.

Der Wechsel ist ein Klick. Fang etwas auf Fast an, entscheide, dass es mehr Tiefe braucht, und verschieb denselben Thread auf eine schwerere Stufe, ohne Dateien oder Verlauf zu verlieren. So arbeiten die meisten tatsächlich: billiges Modell für die Menge, teures für den harten Teil.

Wo Flash aufhört, sinnvoll zu sein

Es ist nicht das Modell für Aufgaben, bei denen ein Fehler teuer wird und du nicht nachsiehst. Entwickler, die DeepSeek intensiv nutzen, sagen meist dasselbe: Es rechtfertigt seinen Preis, wenn man es steuert, und vollautonome Arbeit ohne Prüfmöglichkeit geben sie ihm nicht. Alles Bildbasierte fällt komplett weg. Für langfristige Autonomie an einer Codebasis, die dir wichtig ist, nimm eine schwerere Stufe und überlass Flash die Teile, die du auf einen Blick prüfen kannst.

DeepSeek V4 Flash auf MoClaw gegen die DeepSeek-API

Wähle, was zu deiner KI-Nutzung passt.

MoClaw (Fast-Stufe) DeepSeek-API direkt
Einrichtung Fast wählen. Das ist die ganze Einrichtung. Konto, API-Key, Guthaben und dein eigener Client-Code.
Worauf es zugreifen kann Browser, Dateien, Shell, Zeitpläne und über 50 Skills. Text rein, Text raus. Werkzeuge baust du selbst.
Abrechnung Plan-Credits, keine Peak-Tarife einzuplanen. Pro Token, ab 16. August in Peak und Off-Peak geteilt.
Auf ein stärkeres Modell wechseln Stufe mitten im Thread wechseln, Dateien und Verlauf bleiben. Anderer Anbieter, anderer Endpunkt, andere Rechnung.

FAQ

Kurze Antworten zu Preisen, Datenschutz und Limits.

Was ist DeepSeek V4 Flash?
Das kleinere Modell in DeepSeeks V4-Familie, allgemein verfügbar seit 31. Juli 2026 als Build DeepSeek-V4-Flash-0731. Es behält das Kontextfenster von einer Million Token und die 384K-Ausgabegrenze von V4 Pro, unterstützt Denk- und Nicht-Denkmodus sowie Tool-Calls und kostet rund ein Drittel.
Kann ich DeepSeek V4 Flash auf MoClaw betreiben?
Ja. Flash ist das Modell hinter MoClaws Fast-Stufe. Wähle Fast in der Modellauswahl, und DeepSeek läuft auf deinem MoClaw-Cloud-Computer mit Browser, Dateien, Shell und Zeitplanung bereits angebunden. Kein DeepSeek-Konto und kein API-Key.
Was kostet DeepSeek V4 Flash?
Auf DeepSeeks API 0,14 $ je Million Eingabetoken und 0,28 $ je Million Ausgabe, ab 16. August 2026 dann 0,22 $/0,66 $ off-peak und 0,44 $/1,32 $ im Peak. Auf MoClaw läuft es über Plan-Credits, ohne Abrechnung pro Token und ohne Peak-Uhr.
Reicht V4 Flash, oder sollte ich V4 Pro nehmen?
Für Mengenarbeit mit klarem Plan hält Flash mit: 82.7 auf Terminal Bench 2.1 gegen Pros 87.9. Pro zieht bei langen autonomen Läufen davon, besonders auf DeepSWE mit 62.7 gegen 54.4. Ein verbreitetes Muster ist Planen auf einem schweren Modell und Ausführen auf Flash.
Verarbeitet DeepSeek V4 Flash Bilder?
Nein. Die V4-Familie hat keine Bildeingabe, für Screenshots und gescannte Dokumente braucht dieser Schritt ein anderes Modell.
Brauche ich für die Fast-Stufe einen DeepSeek-API-Key?
Nein. DeepSeek läuft in MoClaw als plattformverwaltete Route. Kein Key zum Einfügen, kein Guthaben aufzuladen und keine separate Anbieterrechnung.
Wie groß ist das Kontextfenster von DeepSeek V4 Flash?
Eine Million Token hinein und bis zu 384K hinaus, genau wie bei V4 Pro. Lange Transkripte, ganze Repositories und große Exporte passen in einen Durchgang.
Kann ich mitten im Gespräch von Flash wechseln?
Ja. Verschieb den Thread auf eine stärkere Stufe, sobald eine Aufgabe mehr Denkleistung braucht; Dateien, Verlauf und Kontext folgen. Die meisten fahren billig für die Menge und wechseln für den harten Teil hoch.

MoClaw kostenlos testen.

Starte kostenlos mit 1.000 Credits.

Jederzeit kündbar