DeepSeek 深夜放大招:V4 Pro 正式版上线,Harness「黑鲸」公测出水

8 月 13 日,DeepSeek 来了个「双响炮」:凌晨,DeepSeek V4 Pro 正式版悄悄上线 API,100 万上下文、38.4 万最大输出,多项指标直逼 Anthropic 的 Fable 5,与马斯克同一天发布的 Grok 4.6 正面对撞;白天,官方 Agent 产品 DeepSeek Harness(代号「黑鲸」)开启开发者预览版公测,对标 Claude Code,还同步开放了 npm 插件生态。两条新闻连起来看,其实就是一句话:DeepSeek 要开始卷 Agent 了,而且用的是自己的打法。

快速速览

  1. V4 Pro 正式版深夜上线 API:100 万上下文、38.4 万最大输出,定价 3 元/百万 Token 输入、6 元/百万 Token 输出;
  2. 性能直逼 Fable 5:多项基准与 Anthropic Fable 5 的差距缩小到 0.1,部分指标超过 Claude Opus 4.8;
  3. 同日对撞 Grok 4.6:梁文锋与马斯克同一天上新,DeepSeek 没有涨价,还搞起了「临时价格战」;
  4. Harness「黑鲸」公测:开发者预览版 v0.1 上线,对标 Claude Code,开放 npm 插件生态,口号是「一切皆插件」。

DeepSeek V4 Pro 正式版

一、V4 Pro 正式版:100 万上下文,价格只有对手的零头

先看模型本身。V4 Pro 正式版这次给的规格相当「实诚」:

V4 Pro 正式版关键参数

  • 上下文窗口:100 万 token;
  • 最大输出:38.4 万 token(一次生成半本书的量级);
  • API 定价:3 元/百万 Token 输入、6 元/百万 Token 输出,约合百万 Token 输出 6 元;
  • 双 API 兼容,沿用 DeepSeek 一贯的生态友好路线;
  • Agent 能力大幅增强,是这代模型的核心卖点。

价格是这次讨论度最高的点。输出每百万 token 只要 6 元,横向对比,Fable 5 和 Opus 4.8 的价格完全不在一个数量级上。更「气人」的是,DeepSeek 还同步宣布 8 月 17 日起上调 V4(Flash)系列的 API 定价——这被不少媒体解读为主动把用户往 V4 Pro 引的「临时价格战」。

性能上,多家媒体的评测口径基本一致:V4 Pro 与「全球最强」的差距被压缩到 0.1 分这个级别,多项指标超过 Claude Opus 4.8,Agent 场景下的表现尤其亮眼。当然也有唱反调的:有实测指出它在部分任务上只比自家 Flash 版高 1 分,认为「先别急着叫梁圣」——评价两极,反而说明这代模型的定位确实微妙:不是全面碾压,而是把「够用 + 便宜 + 长上下文」的组合拳打到了极致。

DeepSeek V4 系列时间线

2026-07-31

DeepSeek V4 正式版发布,Agent 能力大幅升级,Harness 能力首次亮相

2026-08-11

DeepSeek Harness 官方公众号上线,「黑鲸」即将浮出水面的消息开始流传

2026-08-13 凌晨

V4 Pro 正式版 API 上线:100 万上下文、38.4 万输出,与 Grok 4.6 同日对撞

2026-08-13 白天

DeepSeek Harness 开发者预览版 v0.1 面向全球开发者开放公测

2026-08-17

V4(Flash)系列 API 定价上调生效,「临时价格战」落地

二、Harness「黑鲸」出水:它不想做下一个 Codex

如果说 V4 Pro 是「引擎」,那 Harness 就是装在这台引擎上的「驾驶舱」。8 月 13 日,DeepSeek Harness 的开发者预览版(v0.1)正式开放公测,爱范儿首发的体验文章标题很有意思——「它不想做下一个 Codex」。

Harness 是什么?

  • 定位:官方 AI 编程 / Agent 框架,对标 Claude Code,但设计哲学完全不同;
  • 核心理念:Model + Harness = Agent——模型负责智能,Harness 负责把 Agent 需要的所有能力抽象成插件;
  • 插件生态:开放 npm 插件市场,工具调用、MCP 接入、自定义流程全部以插件形式分发;
  • 交付形态:CLI 工具 + MCP server + Python 库,开发者和普通用户都能上手。

DeepSeek Harness 插件生态

这个「一切皆插件」的设计,和 Claude Code 的思路正好相反:Claude Code 是「官方做全功能」,Harness 是「官方只做骨架,能力全交给社区插件」。好处很明显——更新快、体积小、社区参与门槛低;风险也明显——生态冷启动阶段,插件质量和数量都需要时间积累。

值得注意的还有团队背景:据公开报道,Harness 由崔添翼带队,项目从立项到公测节奏极快。加上 7 月底 V4 发布时 Harness 能力就首次亮相,不到两周就开放公测,DeepSeek 这轮「模型 + Agent 框架」的组合拳打得相当紧凑。

三、同一天,两个世界的新对手

把视野拉大一点,8 月 13 日其实是近期 AI 竞争白热化的一个缩影:

深夜两连发:V4 Pro 正式版 + Harness 公测。用「便宜 + 长上下文」打价格带,用「插件化 Agent 框架」打生态位,全程没涨价。

马斯克同日上新 Grok 4.6:单任务成本与 Kimi K3 持平,中美大模型的价差正在收窄。

被反复拉出来对比:Fable 5 依然是各家「全球最强」的对标基准,DeepSeek 这次把差距追到 0.1。

对普通用户来说,最直接的感受是:顶尖模型能力的门槛正在被价格战快速拉低。V4 Pro 的输出定价折合人民币约 6 元/百万 token,意味着写一篇几千字的文章、跑一个中等规模的 Agent 任务的成本已经降到「几毛钱」级别。这也是为什么我说 DeepSeek 这轮的真正看点不在「赢没赢过 Fable 5」,而在「把 Agent 的门票打到了白菜价」。

写在最后

V4 Pro 负责把「智能的单价」打下来,Harness 负责把「智能的载体」铺开——模型和框架同一天发布,DeepSeek 的野心已经写得很明白了:不只是做一个便宜的模型厂,而是要做从模型到 Agent 的完整链条。

对开发者来说,这两天值得动手的:一是去 API 控制台看看 V4 Pro 的长上下文价格;二是 npx 装一下 Harness,逛逛刚开放的 npm 插件市场——生态刚起步的时候,往往也是红利最大的时候。这期就到这里,下期见。

参考链接