DeepSeek V4 Pro正式版深夜“突袭”
2026-08-12 11:25:06 · chineseheadlinenews.com · 来源: 华尔街日报
DeepSeek V4 Pro正式版似乎在毫无预告的情况下突然上线。

北京时间8月12日周三深夜,DeepSeek官网API文档悄然更新,模型版本已经从此前的V4-Pro预览版切换至DeepSeek-V4-Pro-0813。官方“模型 & 价格”页面目前已经将deepseek-v4-pro对应的模型版本明确标为DeepSeek-V4-Pro-0813,同时API价格匝檀出现明显上调。
这意味着,DeepSeek V4 Pro正式版很可能已经开始通过API灰度或正式提供服务。多家科技媒体援引DeepSeek官方群流出的评测对比表称,新模型在多项智能体(Agent)测试中的表现已经逼近Anthropic前沿模型Claude Fable 5,部分项目甚至超过Fable 5;相比此前的V4 Pro预览版,整体表现明显提升。

更巧合的是,DeepSeek这次更新几乎与马斯克旗下SpaceXAI发布Grok 4.6同步。两款主打高性价比的模型几乎同时冲击前沿模型第一梯队,AI大模型价格与性能竞争再度升温。
API文档悄然换版,官方仍未发布正式更新日志
从DeepSeek官网的变化来看,这次V4 Pro正式版上线颇为低调。
目前DeepSeek API官方“模型 & 价格”页面已经显示,deepseek-v4-pro对应的模型版本为DeepSeek-V4-Pro-0813;该模型支持1M上下文、最高384K输出,并支持JSON Output、Tool Calls、Responses API、Anthropic API以及FIM等功能。

官方“首次调用API”页面也已经将可调用模型列为deepseek-v4-pro,并给出了使用该模型进行思考模式调用的示例。

但值得注意的是,DeepSeek目前并没有同步发布V4-Pro-0813的官方更新日志。
DeepSeek的更新日志页面最新一条仍是7月31日的V4-Flash正式版更新。该公告当时明确表示,7月31日仅升级V4-Flash API,V4-Pro API及App/Web端模型并未改变,并称“DeepSeek-V4-Pro正式版将会尽快发布”。截至目前,这一更新日志页面仍未出现V4-Pro-0813的正式发布说明。
由于最先发现变化的并不是DeepSeek官方公告,而是API文档和实际调用端。因此,严格来说,现阶段更适合将此次事件视为DeepSeek V4 Pro正式版已通过API上线,而并非DeepSeek已发布完整、正式的V4 Pro产品公告。
多项智能体测试逼近Fable 5,预览版到正式版提升明显
真正引发市场必注的,是已经在AI社区流传的评测对比表。
媒体援引DeepSeek官方群发布的评测表称,DeepSeek V4 Pro正式版,即DeepSeek-V4-Pro-0813,在多项测试中已经接近Fable 5水平,相比此前的V4 Pro预览版能力出现大幅提升。
其中尤其值得关注的是智能体相关测试。
与传统大模型主要考察知识问答、数学推理不同,智能体测试更加接近AI“真正干活”的能力,包括能否调用工具、执行多步骤任务、编写和修改代码,以及持续推进复杂工作。
这也是DeepSeek V4系列从一开始就重点押注的方向。
DeepSeek在4月发布V4预览版时就强调,V4 Pro在Agentic Coding评测中达到当时开源模型领先水平,并针对Claude Code、OpenClaw、OpenCode、CodeBuddy等主流Agent产品进行了适配和优化。V4 Pro同时支持1M上下文以及思考模式,可通过reasoning_effort调整思考强度。
7月31日发布V4 Flash正式版时,DeepSeek又披露了智能体能力的大幅增强,包括Terminal Bench 2.1达到82.7、NL2Repo达到54.2、DeepSWE达到54.4、Toolathlon verified达到70.3等,并明确表示正式版智能体能力远超V4-Pro-Preview。
如今V4 Pro正式版进一步向Fable 5靠拢,意味着DeepSeek此前在Agent方向的积累正在通过后训练和工程优化转化为更强的实际任务执行能力。
不过,由于目前流传的新版评测表主要来自官方群及社区,DeepSeek尚未在官方更新日志中公布完整的V4-Pro-0813基准成绩,因此这些具体分数仍应视为非官方披露数据,而不能与DeepSeek正式发布的基准成绩完全等同。
价格匝檀上调,但官网已经预告近期将大幅涨价
价格是这次V4 Pro正式版上线的另一大看点。
截至目前,DeepSeek官方API价格页面仍显示,V4 Pro每百万Token的缓存命中输入价格为0.003625美元,缓存未命中输入价格为0.435美元,输出价格为0.87美元;按照此前人民币计价口径,大致对应3元/百万Token输入、6元/百万Token输出。
也就是说,新版V4 Pro目前并没有因为模型能力提升而同步涨价。
此前DeepSeek已经把V4 Pro API价格从首发价格永久下调至原价的四分之一,输入缓存命中、输入缓存未命中和输出价格分别降至0.025元、3元和6元/百万Token。
不过,这次官网实际上埋下了一个值得关注的伏笔。
DeepSeek目前在价格页面明确写明:“我们计划在不久的将来上调DeepSeek API服务的整体价格”,而且“预计涨幅较大”,但具体价格仍需等待官方通知。
因此,当前V4 Pro正式版“能力升级、价格暂不变”的状态,未必能够长期维持。
这也让此次更新更像是一场在涨价之前的性能升级与产品切换:DeepSeek先把新模型推向API用户,随后再根据算力供给、调用量和商业化情况调整价格。
一边是DeepSeek,一边是Grok:前沿模型竞争突然“撞车”
如果没有Grok 4.6,这次DeepSeek V4 Pro的突然上线可能已经足够引发市场必注。
但时间点实在太巧。
就在DeepSeek V4 Pro-0813悄然上线前几个小时,SpaceXAI刚刚发布Grok 4.6。
Grok 4.6在Artificial Analysis推出的GDPVal-AA v2——一项面向真实世界专业知识工作的AI智能体评估——中取得1753 Elo,排名第一,超过OpenAI前沿模型GPT-5.6 Sol Max的1728分,以及Anthropic的Claude Fable 5的1741分。SpaceXAI同时称,Grok 4.6在Artificial Analysis Intelligence Index中取得61分,与GPT-5.6 Sol Max持平。
更重要的是价格:Grok 4.6 API定价为每百万输入Token 2美元、输出6美元,SpaceXAI直接将其定位为其他前沿模型的一半价格。
如今DeepSeek V4 Pro-0813又在多项测试中逼近Fable 5,而且目前仍维持每百万Token输入3元、输出6元的价格。
两款模型几乎在同一时间向市场释放了类似信号:前沿模型的能力差距正在缩小,而价格优势正在成为新的竞争武器。
这对OpenAI、Anthropic等传统前沿模型厂商而言,压力并不仅仅来自“谁的跑分更高”。
此前AI模型竞争更多围绕“最强模型”展开,而随着DeepSeek和Grok不断把性能推向第一梯队,市场开始出现另一种竞争逻辑:如果性能已经足够接近,开发者为什么要为更贵的模型支付数倍成本?
从“便宜”到“能干活”,DeepSeek重新冲击智能体市场
DeepSeek V4 Pro此次升级的意义,也可能超过一次普通的模型版本迭代。
今年4月V4发布时,DeepSeek就已经把重点从传统聊天模型转向Agent,并将百万Token上下文、代码工程和工具调用能力作为核心卖点。
随后V4 Flash正式版上线,又重点强化Code Agent和Search Agent等能力。DeepSeek在7月31日的更新中甚至直接表示,V4 Flash正式版的智能体能力大幅增强,并在多项智能体基准测试中明显超过V4-Pro-Preview。
如今V4 Pro正式版继续向Fable 5等顶级闭源模型靠拢,说明DeepSeek的竞争目标已经不再只是“做一个更便宜的通用大模型”,而是试图在AI从聊天走向实际工作的过程中,争夺Agent基础模型的位置。
而这恰恰也是Grok 4.6此次升级的核心方向。
Grok 4.6同样将长时间运行的智能体、复杂编程和知识工作作为重点,并在Cursor等开发者入口直接提供服务。
因此,DeepSeek V4 Pro-0813与Grok 4.6的“同日撞车”,某种程度上也折射出AI行业竞争的新阶段:
前沿模型的竞争正在从单纯比拼参数和聊天能力,转向比拼智能体执行能力、Token成本以及开发者生态。
而这场竞争,可能才刚刚开始。