Modèles d'IA

DeepSeek V4 Flash, en fonctionnement dans MoClaw

DeepSeek V4 Flash est le modèle du palier Fast de MoClaw : 1M de contexte, affiné pour les agents, environ un tiers du prix de V4 Pro. Choisissez Fast et lancez-vous.

DeepSeek V4 Flash

MoClaw est un ordinateur IA géré indépendant qui vous permet d'exécuter des modèles de pointe sans installation ni auto-hébergement.

Toutes les intégrations

DeepSeek V4 Flash en action

Démos de la communauté et travaux open source bâtis sur DeepSeek V4 Flash, pas des sorties MoClaw.

Démo DeepSeek V4 Flash — Un agent de rapport boursier qui rédige son propre .docx, créée par @farhanhelmycode

Un agent de rapport boursier qui rédige son propre .docx

DeepSeek V4 Flash pilote un agent web sur 12 étapes et 31 appels d'outils en 11,8 secondes, jusqu'à un rapport Word terminé, produit par Python dans un bac à sable Docker. Exactement la longue chaîne d'outils que Flash est assez bon marché pour relancer sans compter.

Démo par @farhanhelmycode Ouvrir
Démo DeepSeek V4 Flash — Faire tourner V4 Flash en local sur Metal, CUDA et ROCm, créée par antirez

Faire tourner V4 Flash en local sur Metal, CUDA et ROCm

ds4 est un moteur d'inférence écrit en C, sous licence MIT et fort de 21,4k étoiles, pour exécuter DeepSeek V4 Flash et V4 Pro sur votre propre matériel, avec le décodage spéculatif DSpark. Il montre aussi le travail que représente réellement l'auto-hébergement.

Open source · antirez/ds4 Ouvrir

Comment ça marche

3 étapes pour connecter DeepSeek V4 Flash, sans effort d’ingénierie.

  1. 1

    Choisissez Fast dans le sélecteur de modèles

    Fast, c'est DeepSeek V4 Flash. Aucune clé à coller, aucun compte DeepSeek à créer ; MoClaw gère le côté fournisseur.

  2. 2

    Confiez-lui une tâche, pas une invite

    Ici Flash tourne sur un vrai ordinateur : demandez le résultat. Lis ces fichiers, consulte ce site, mets le résultat dans un tableur.

  3. 3

    Montez d'un palier quand ça bloque

    Si une tâche demande plus de raisonnement, changez de palier en cours de fil. Fichiers, historique et contexte suivent.

Pourquoi DeepSeek V4 Flash est le palier Fast de MoClaw

Qu'est-ce que DeepSeek V4 Flash ?

DeepSeek V4 Flash est la moitié la plus petite et la plus rapide de la famille V4, et il est passé en disponibilité générale le 31 juillet 2026 sous la build DeepSeek-V4-Flash-0731. DeepSeek a conservé l'architecture et la taille de la préversion et a seulement refait le post-entraînement, d'où la surprise du bond de capacité : d'après les chiffres de DeepSeek, le Flash final devance la préversion de V4 Pro sur les benchmarks agentiques publiés.

Il reprend la même fenêtre de contexte d'un million de tokens et le même plafond de 384K en sortie que V4 Pro, les mêmes modes avec et sans raisonnement, les appels d'outils, la sortie JSON et les mêmes points d'accès compatibles OpenAI et Anthropic. Comme le reste de la famille, il n'a pas d'entrée visuelle.

Les benchmarks de DeepSeek V4 Flash

DeepSeek annonce Terminal Bench 2.1 à 82.7, DeepSWE à 54.4, NL2Repo à 54.2, CyberGym à 76.7 et Toolathlon-Verified à 70.3. Pour un modèle à ce prix, l'ensemble est étonnant, et la réaction des développeurs l'a montré : sur Hacker News, plusieurs ont décrit Flash 0731 comme le plus grand saut des deux sorties, la version finale de V4 Pro quinze jours plus tard passant pour la plus discrète.

Tout cela vient du constructeur. DeepSeek a néanmoins ouvert le framework agentique utilisé, DeepSeek Harness, sous licence MIT en préversion développeur : l'échafaudage est donc public.

Tarifs de DeepSeek V4 Flash

Tels que publiés, Flash coûte 0,14 $ par million de tokens en entrée hors cache, 0,0028 $ avec cache et 0,28 $ par million en sortie. À partir de 16:00 UTC le 16 août 2026, la famille V4 bascule en heures pleines / heures creuses : Flash tombe à 0,44 $ en entrée et 1,32 $ en sortie en heures pleines, 0,22 $ et 0,66 $ en heures creuses, le pic étant défini de 01:00 à 04:00 et de 06:00 à 10:00 UTC.

Sa limite de concurrence est de 2 500 contre 500 pour V4 Pro, ce qui compte davantage que le prix pour tout ce qui ressemble à du traitement par lots.

Faire tourner DeepSeek V4 Flash sur MoClaw

Sur MoClaw, Flash est le palier Fast. Choisissez Fast dans le sélecteur de modèles et vous exécutez DeepSeek V4 Flash sur un ordinateur cloud managé : système de fichiers persistant, navigateur qui conserve sa session, shell, planification et plus de 50 compétences déjà branchées. DeepSeek y tourne géré par la plateforme : aucun compte DeepSeek à ouvrir, aucune clé à stocker, aucune horloge d'heures pleines à intégrer. Les crédits d'abonnement couvrent l'usage.

Le changement tient en un clic. Commencez sur Fast, jugez qu'il faut plus de profondeur, et déplacez le même fil vers un palier supérieur sans perdre vos fichiers ni votre historique. C'est la façon dont la plupart travaillent vraiment : modèle bon marché pour le volume, modèle cher pour la partie difficile.

Là où Flash cesse d'être pertinent

Ce n'est pas le modèle pour une tâche où l'erreur coûte cher et que vous ne relirez pas. Les développeurs qui utilisent DeepSeek intensivement disent à peu près la même chose : il vaut son prix quand on le pilote, et ils ne lui confient pas de travail totalement autonome qu'ils ne peuvent pas vérifier. Tout ce qui repose sur des images est exclu. Pour de l'autonomie au long cours sur une base de code qui compte, montez d'un palier et laissez à Flash ce que vous pouvez vérifier d'un coup d'œil.

DeepSeek V4 Flash sur MoClaw ou l'API DeepSeek

Choisissez l’option qui correspond à votre usage de l’IA.

MoClaw (palier Fast) API DeepSeek directe
Mise en place Choisir Fast. Toute la mise en place tient là. Compte, clé d'API, solde prépayé et votre propre code client.
Ce qu'il peut atteindre Navigateur, fichiers, shell, planifications et plus de 50 compétences. Du texte en entrée, du texte en sortie. Les outils, c'est à vous de les bâtir.
Facturation Crédits d'abonnement, aucun tarif de pointe à anticiper. Au token, réparti en heures pleines et creuses depuis le 16 août.
Passer à un modèle plus puissant Changez de palier en cours de fil, fichiers et historique restent. Autre fournisseur, autre point d'accès, autre facture.

FAQ

Réponses rapides sur le prix, la confidentialité et les limites.

Qu'est-ce que DeepSeek V4 Flash ?
Le petit modèle de la famille V4 de DeepSeek, en disponibilité générale depuis le 31 juillet 2026 sous la build DeepSeek-V4-Flash-0731. Il garde la fenêtre de contexte d'un million de tokens et le plafond de 384K en sortie de V4 Pro, gère les modes avec et sans raisonnement ainsi que les appels d'outils, et coûte environ un tiers du prix.
Puis-je faire tourner DeepSeek V4 Flash sur MoClaw ?
Oui. Flash est le modèle derrière le palier Fast de MoClaw. Choisissez Fast dans le sélecteur et DeepSeek s'exécute sur votre ordinateur cloud MoClaw, avec navigateur, fichiers, shell et planification déjà branchés. Sans compte DeepSeek ni clé d'API.
Combien coûte DeepSeek V4 Flash ?
Sur l'API DeepSeek, 0,14 $ par million de tokens en entrée et 0,28 $ par million en sortie, avec passage le 16 août 2026 à 0,22 $/0,66 $ en heures creuses et 0,44 $/1,32 $ en heures pleines. Sur MoClaw il fonctionne sur crédits d'abonnement, sans comptage au token ni horloge de pointe.
V4 Flash suffit-il, ou faut-il V4 Pro ?
Pour du travail de volume avec un plan clair, Flash tient : 82.7 sur Terminal Bench 2.1 contre 87.9 pour Pro. Pro prend l'avantage sur les longues exécutions autonomes, en particulier sur DeepSWE avec 62.7 contre 54.4. Un schéma courant consiste à planifier sur un gros modèle et à exécuter sur Flash.
DeepSeek V4 Flash traite-t-il les images ?
Non. La famille V4 n'a pas d'entrée visuelle : captures d'écran et documents scannés exigent un autre modèle pour cette étape.
Faut-il une clé d'API DeepSeek pour le palier Fast ?
Non. DeepSeek fonctionne comme route gérée par la plateforme dans MoClaw. Aucune clé à coller, aucun solde à créditer, aucune facture fournisseur séparée.
Quelle est la fenêtre de contexte de DeepSeek V4 Flash ?
Un million de tokens en entrée et jusqu'à 384K en sortie, comme V4 Pro. Longues transcriptions, dépôts entiers et gros exports passent en une seule fois.
Puis-je quitter Flash en cours de conversation ?
Oui. Déplacez le fil vers un palier plus puissant dès qu'une tâche demande plus de raisonnement ; fichiers, historique et contexte suivent. La plupart restent économes sur le volume et montent pour la partie difficile.

Essayez MoClaw gratuitement.

Commencez gratuitement avec 1 000 credits.

Annulation à tout moment