V4、涨价与 Harness 同时落地,DeepSeek 想做的已经不只是模型

2026 年 7 月 31 日,DeepSeek-V4-Flash 正式版在 API 上线公测。发布说明里有一条很容易被跑分盖过去的注记。公共基准集中的 Code Agent 任务,使用了当时还没有发布的 DeepSeek Harness 极简模式。 十三天以后,那条注记里的产品露面了。 8 月 13 日,三项变化同日通过不同官方渠道出现。DeepSeek-V4-Pro 正式版在 APP、网页端和 API 同步上线,API 更新价格也写入官方更新日志与8 月 13 日公告。DeepSeek Harness v0.1 则在官方产品页和官方仓库开放开发者预览。新价格把一天切成高峰与空闲两类时段,并从 8 月 17 日起执行。 若只逐条看,这是两次模型更新、一次调价和一个开源项目。放到同一条时间线上,问题就变了。为什么模型档位、调用接口、价格时段和 Agent 执行框架会在同一阶段落地? 这四件事分别落在一项任务的不同位置。模型先决定每次推理能做到什么,接口决定现有客户端要改多少,价格决定多轮调用会花多少钱,执行框架则决定模型怎样碰到工具、文件和外部动作。单独报道任何一项都没有错,可它解释不了另外三项为什么紧挨着出现。真正需要解释的是这套组合。 我的判断是,DeepSeek 正把竞争单位从一次模型调用扩展到一次完整的 Agent 任务。Flash 和 Pro 分担不同强度的任务,兼容接口降低接入成本,峰谷价格改变任务运行的经济时点,Harness 再把模型、工具和执行过程接起来。这是基于发布节奏与产品组合做出的作者判断,DeepSeek 没有宣布一套这样的路由政策或平台战略。 两档 V4 开始回答同一个任务该用多少能力 7 月 31 日的更新范围很窄。V4-Flash 正式版只更新 API,APP、网页端以及当时的 Pro API 都没有变化。它的模型结构和尺寸与 Flash Preview 保持一致,只重新进行了后训练。这个信息把 Flash 的角色说得相当清楚。DeepSeek 没有把它包装成一次规模跃升,而是把已有模型继续往 Agent 任务上调。 “只重新进行了后训练”也划出了一条事实边界。官方材料没有公布一套新的架构变化,本文也不能从基准提升倒推出模型规模、推理吞吐或线上稳定性发生了怎样的改变。能确认的是,DeepSeek 在结构和尺寸不变的前提下更新了 Flash 的任务表现,并把更新入口限定在 API。它更接近面向调用量与 Agent 接入的产品更新,APP 和网页端用户在 7 月 31 日并没有拿到同一次升级。 ...

August 14, 2026 · 3 min · 469 words · 钟懿