AI 模型

DeepSeek V4 Pro,以及它需要的那台电脑

DeepSeek V4 Pro 于 2026 年 8 月 13 日正式发布:100 万上下文、384K 输出、为 agent 调优。MoClaw 给这类模型一台真正能干活的电脑。

DeepSeek V4 Pro

MoClaw 是一台独立的托管 AI 电脑,无需配置、无需自建即可运行前沿模型。

全部集成

看 DeepSeek V4 Pro 的实际效果

社区实测与第三方基准测试,非 MoClaw 产出。

DeepSeek V4 Pro 演示 —— SWE-bench Verified 开源权重第一,由 @_avichawla 制作

SWE-bench Verified 开源权重第一

DeepSeek V4 Pro 在 SWE-bench Verified 上拿下开源权重第一,处于 GPT-5.5 区间。这条推真正的重点是这个数字没说的部分:单一任务集、单一 harness、单一服务精度。把 V4 Pro 真正跑进生产的团队,靠的是围着它搭起来的 harness。

Demo 来自 @_avichawla 打开
DeepSeek V4 Pro 演示 —— Coding Agent Index 里 V4 Pro 每个任务 $0.35,由 @ArtificialAnlys 制作

Coding Agent Index 里 V4 Pro 每个任务 $0.35

Artificial Analysis 把模型和 harness 放在一起测。DeepSeek V4 Pro 配 Claude Code 得 50 分,与 Kimi K2.6 持平、落后 GLM-5.1 的 53 分,但每个任务只要 $0.35,而 GPT-5.5 配 Codex 是 $2.21。

Demo 来自 @ArtificialAnlys 打开
DeepSeek V4 Pro 演示 —— 从一段录屏重建一款 FPS,由 @exploraX_ 制作

从一段录屏重建一款 FPS

一段游戏录屏、一条相同的提示词,两个模型各自复现。Claude Fable 5 出来的更精致;DeepSeek V4 Pro 拿下了更难的那个机制——配件会实时改变屏幕上的枪械模型。

Demo 来自 @exploraX_ 打开

工作方式

3 步接入 DeepSeek V4 Pro,无需工程配置。

  1. 1

    打开 MoClaw,把活说清楚

    不用安装、不用 key、不用进服务商后台。像交代外包一样把任务写出来,包括你不希望它碰的部分。

  2. 2

    看着它在一台真机器上干活

    MoClaw 在一台带浏览器和文件系统的持久化云电脑上执行任务,所以你能看到终端、打开它生成的文件,也能在跑歪的时候随时介入。

  3. 3

    让它一直跑着

    设好定时,关掉标签页,回来取结果。这台机器会在多次运行之间保留你的文件、历史和凭据。

DeepSeek V4 Pro 改变了什么,又还缺什么

DeepSeek V4 Pro 是什么?

DeepSeek V4 Pro 是 DeepSeek 的旗舰模型,并在 2026 年 8 月 13 日结束预览,正式版构建号为 DeepSeek-V4-Pro-0813,同时上线 App、网页端和 API。API 名称没变;本来就在调用 deepseek-v4-pro 的人,一觉醒来就已经在用正式版了。

规格和预览版是同一套:100 万 token 上下文窗口、最高 384K 输出 token、思考与非思考两种模式、工具调用、JSON 输出,以及 OpenAI 与 Anthropic 两种兼容接口。变的是后训练。DeepSeek 这次明确对准 agent,官方措辞谈的是生产环境,而不是聊天。

有一件事 V4 Pro 做不了:图片。它没有视觉输入,所以以截图为起点的活、以及任何从扫描件开始的流程都不适合它。

DeepSeek V4 Pro 的跑分,以及是谁测的

DeepSeek 随正式版公布了十项分数,其中 agent 相关的最值得看:Terminal Bench 2.1 87.9、DeepSWE 62.7、NL2Repo 61.5、CyberGym 83.3、Toolathlon-Verified 74.1,HLE 无工具 42.7、有工具 60.0。相对预览版,DeepSeek 给出的差值是 Terminal Bench +15.8、DeepSWE +49.9。

这些都是厂商自测数据,读的时候要带着这个前提。不过 DeepSeek 确实把跑分用的 agent 框架放了出来:DeepSeek Harness,MIT 协议,以开发者预览的形式发布,至少这套脚手架是可以检查的。第三方复现仍然没有。

开源权重是另一回事。DeepSeek 在 Hugging Face 上以 MIT 协议发布了 1.6T 参数的 V4 Pro,但那份权重最后更新于 2026 年 6 月 22 日,而更新日志把 0813 写成 API 与 App 的更新,不是新的 checkpoint。也就是说,你自己部署,拿到的不是正式版。

DeepSeek V4 Pro 的价格,以及 8 月 16 日之后的变化

按目前公布的价格,V4 Pro 每百万输入 token 未命中缓存 $0.435、命中缓存 $0.003625,每百万输出 token $0.87。2026 年 8 月 16 日 16:00 UTC 起,DeepSeek 会把整个 V4 系列切到高峰/低谷计费:低谷每百万输入 $0.66、输出 $1.98,高峰则是 $1.32 和 $3.96,高峰时段为 UTC 01:00–04:00 和 06:00–10:00。低谷价是高峰价的一半,这也正是拆分的用意。

跟西方前沿模型比它仍然便宜,但这同时是一次涨价,外加一个你从此得算的时钟。Hacker News 上的开发者几个小时内就注意到了,其中那些早已默认用 V4 Pro 的人反应最大。

模型只是 agent 的一半

那个帖子里被重复最多的观点和跑分无关:harness 的权重不亚于模型本身。同样的权重,换一套脚手架,结果就不一样,而两个主流编码 harness 之间的差距,可能比两档模型之间的差距还大。DeepSeek 显然也是这么想的,否则不会在同一天把自家 harness 开源。

这恰恰是买一个 API key 换不来的部分。一个能连跑几小时的 agent 模型,需要一台同样能连跑几小时的机器:真实的文件系统、会保持登录态的浏览器、记得上一步做过什么的终端,以及一个让产出落地的地方。

MoClaw 在其中的位置

MoClaw 就是那台机器。它是一台托管云电脑,带持久磁盘、浏览器、shell、定时调度,以及 50 多个已经接好的技能;DeepSeek 在这里是平台托管的模型,所以没有 DeepSeek 账号、没有需要轮换的 API key,也不用做高峰时段的算术。你花的是套餐额度,服务商那一侧由 MoClaw 处理。

今天这个平台托管的 DeepSeek 是 V4 Flash,也就是 MoClaw Fast 档跑的模型。如果你现在就想让 DeepSeek 在一台真正的电脑上干活,从 Fast 开始,V4 Pro 的进展就盯这个页面。

在 MoClaw 上用 DeepSeek V4 Pro,与自己调 DeepSeek API

选择最符合你使用 AI 方式的一项。

MoClaw(托管) 直接调 DeepSeek API
如何开始 打开对话直接输入,没有任何配置。 注册 DeepSeek 账号、生成 key、充值余额、接好接口。
活在哪里跑 一台持久化云电脑,带浏览器、shell、文件和定时任务。 跑在你自己搭的地方。API 只返回文本,harness 得你自己写。
计费 套餐额度。没有高峰时钟,也不用逐条对账。 按 token 计费,8 月 16 日起还要分高峰和低谷。
换模型 对话中途切换模型,文件和历史跟着走。 换服务商、换接口、换一个账单。

FAQ

关于价格、隐私和限制的快速回答。

DeepSeek V4 Pro 是什么?
DeepSeek V4 Pro 是 DeepSeek 的旗舰模型。正式版构建 DeepSeek-V4-Pro-0813 于 2026 年 8 月 13 日发布,配备 100 万 token 上下文窗口、最高 384K 输出 token、默认开启的思考模式、工具调用,并原生支持 OpenAI Responses API,同时提供 Anthropic 兼容接口。
现在能在 MoClaw 上用 DeepSeek V4 Pro 吗?
模型选择器里还选不到。MoClaw 以平台托管的方式运行 DeepSeek,目前 Fast 档背后的模型是 DeepSeek V4 Flash。V4 Pro 在对话里还不可选,所以这个页面只跟踪模型本身,不会声称一个并不存在的档位。想现在就让 DeepSeek 在一台真机器上干活,就从 Fast 开始。
DeepSeek V4 Pro 多少钱?
按公布价格,每百万输入 token 未命中缓存 $0.435,每百万输出 $0.87。2026 年 8 月 16 日 16:00 UTC 起,V4 系列改为高峰/低谷计费:高峰每百万输入 $1.32、输出 $3.96,低谷减半,高峰时段为 UTC 01:00–04:00 和 06:00–10:00。在 MoClaw 上你花的是套餐额度,完全不用管这个时钟。
DeepSeek V4 Pro 和 V4 Flash 有什么区别?
Pro 更大,在 DeepSeek 自己的 agent 跑分上更高(Terminal Bench 2.1 是 87.9 对 82.7,DeepSWE 是 62.7 对 54.4)。Flash 的价格约为 Pro 的三分之一,并发上限是它的五倍,而且早两周就正式发布。很多开发者用大模型做规划,用 Flash 执行。
DeepSeek V4 Pro 是开源的吗?
权重在 Hugging Face 上以 MIT 协议发布,参数量 1.6T,协议本身确实宽松。但那份权重最后更新于 2026 年 6 月 22 日,而 DeepSeek 把 0813 作为 API 和 App 的更新发布,并非新的 checkpoint,所以自部署拿不到正式版。
DeepSeek V4 Pro 支持图片吗?
不支持。它没有视觉输入,截图、扫描版 PDF、示意图都处理不了。如果你的流程从一张图开始,那一步得换别的模型。
DeepSeek Harness 是什么?
DeepSeek 自家的 agent 框架,随正式版一起以 MIT 协议、开发者预览的形式发布,代码类跑分就是用它跑的。它是插件式架构,本地用 npx 就能起。有用,同时也在提醒一件事:模型本身并不等于产品。
在 MoClaw 上跑 DeepSeek 任务需要 API key 吗?
不需要。DeepSeek 在 MoClaw 内部是平台托管的线路,不用注册 DeepSeek 账号、不用保存 key,也没有单独的服务商账单。套餐额度就够了。
DeepSeek V4 Pro 的 effort 档位有哪些?
思考模式支持 low、high、max 三档。DeepSeek 建议简单任务用 low、日常 agent 任务用 high、值得多花 token 的难题用 max。如果请求里写 medium,会被映射到 high。

免费试用 MoClaw。

免费领取 1,000 credits 开始使用。

随时取消