
21 世纪经济报道记者 石恩泽
8 月 12 日晚间,DeepSeek 通过 API 文档更新悄然上线了 DeepSeek-V4-Pro-0813,即外界等待近四个月的 V4 Pro 正式版。
当海外旗舰模型的输出定价还停留在每百万 Token 数十美元时,这家中国公司把逼近第一梯队的 Agent 能力,标出了每百万 Token 输入 3 元、输出 6 元的价格,约为 Claude Fable 5 的 1/57。
这并非一次常规迭代。V4 Pro 正式版未改动模型架构与参数规模,仅通过重新后训练,便在多项 Agent 基准测试上较预览版大幅跃升:DeepSWE 得分涨了近 4 倍,终端操作测试 Terminal Bench 2.1 距 Fable 5 仅差 0.1 分。
从 V4-Flash 正式版以" 1 元输入、2 元输出"横扫开发者市场,到 V4 Pro 正式版把旗舰级性能拉进个位数元的价格带,DeepSeek 正在重写前沿智能的价格锚点。
网上杠杆配资而就在发布前夕,官方已在 API 文档中预告:近期将整体上调定价,"预计涨幅较大"——这场定价权之争,才刚刚开始。
Pro 把性能上限推向第一梯队,Flash 守住性价比底线
从公开架构规格看,V4 Pro 为混合专家(MoE)模型,总参数约 1.5 万亿至 1.6 万亿(各方口径不一,SemiAnalysis 称 1.5T,此前官方披露口径为 1.6T),每次推理激活约 490 亿参数;V4 Flash 总参数约 2840 亿,每次推理激活参数约 130 亿。两者均提供 100 万 Token 上下文与最高 38.4 万 Token 输出。
本次正式版最重要的变化不是更大,而是更会干活。同样的权重,仅通过后训练策略迭代,Agent 能力出现质变。

其中,DeepSWE 从 12.8 分跃升至 62.7 分,涨了近 4 倍;Terminal Bench 2.1 升至 87.9 分,距 Fable 5 仅差 0.1 分,并超越 Opus 4.8;CyberGym 实现反超。七项测试中 Pro 全面领先 Flash,性能梯度清晰。
价格上,根据 DeepSeek 官方 API 文档,截至 8 月 13 日,V4 Pro 正式版维持预览版定价,恰好是 Flash 的 3 倍。

换算下来,缓存命中价两者几乎持平,差距集中在缓存未命中输入与输出,均为 Flash 的 3 倍;并发额度则相反,Pro 仅为 Flash 的五分之一,高并发业务或仍倾向 Flash。
此外,V4 Pro 正式版补齐了接口能力。新增支持 Responses API 并适配 Codex,同时兼容 OpenAI 与 Anthropic 两套 API 格式,从 Claude 生态迁移的改造成本较低。
另一个从无到有的变化是多模态。据科技媒体极客公园 8 月 13 日发布的 API 实测报道,预览版为纯文本模型,正式版首次原生支持图像推理。DeepThink 引擎可在同一个思考流程中分析图片、解读截图、处理图文混合文档,这对需要"看图干活"的 Agent 场景而言是从零到一的突破。
不过截至发稿,DeepSeek 官方 API 文档尚未列出图像输入的调用说明,该能力的全量开放节奏仍待确认。
换句话说,DeepSeek 用两条产品线完成了分层:Flash 以约三分之一的价格、5 倍的并发额度承担走量任务,Pro 则把国产模型的 Agent 性能上限推到了第一梯队门口。
横向看,V4 Pro 输出价格折合约 0.87 美元 / 百万 Token,而 Claude Fable 5 的输出定价为 50 美元 / 百万 Token,前者仅约为后者的 1/57。

市场的正面评价,同样集中在性价比上。第三方研究机构 SemiAnalysis 称其在智能体任务上,大幅超越英伟达 Nemotron3 Ultra;科技媒体实测后评价其"无限逼近 Fable 5 ";申万宏源、国联证券、民生证券等券商研报亦指出,其性价比利好 AI 应用产业链。
Harness、多模态与涨价方案成为市场下一步的考题
元股证券:ygzq.hk叫好之外,质疑声同样不少,而这些质疑恰好勾勒出市场的下一步期待。
部分 API 用户实测反馈,V4 Pro 正式版思维链(CoT)表现不及预期。
极客公园实测发现,在复杂代码生成任务中,思考模式下的推理 Token 可占输出配额的八成以上,挤压了正文代码空间,导致代码截断,开发者需主动关闭思考模式或提高输出上限;目前流传的跑分出自官方渠道,由尚未开放的自研 Harness 环境测得,第三方复现仍需时间,且 HLE、NL2Repo 等纯知识与复杂工程测试仍落后于 Opus 4.8 和 Fable 5。
此外,受推理算力不足影响,官方 API 近期多次出现性能下降,Pro 版 500 的并发上限对高并发业务并不友好。同时,官方涨价预告悬而未决。目前每百万 Token 输入 3 元、输出 6 元的定价更像一个"阶段性低价窗口"。
不过,质疑并未动摇市场对 V4 Pro 正式版的基本判断。模型的能力上限已被证实,剩下的都是何时补齐的问题。
市场目前的关注点,已转向三件事。
其一是 Harness。记者了解到,DeepSeek 近期已在密集组建 Harness(智能体运行框架)团队,由崔添翼挂帅对外招聘," DeepSeek Harness 团队"官方微信公众号已完成注册。
DeepSeek 内部有个公式:Model + Harness = Agent。模型是发动机,Harness 是方向盘、变速箱、刹车。没有 Harness,模型就是个裸 API。有了 Harness,模型才能变成真正能干活的产品。
Claude Code 与 Codex 的体验差距从来不只是由底层模型决定的。因此,Harness 何时开放,被视为 DeepSeek 的下一张牌。
其二是多模态的开放节奏。图像推理的补齐让 V4 Pro 正式版迈出了从纯文本到多模态的第一步,但官方文档与技术报告尚未确认该能力,全量开放时间表不明。另外,视频等更完整的多模态能力,或仍需等待后续版本。在 Opus、GPT 等对手均已标配视觉能力的背景下,这一步的落地节奏尤为关键。
其三是涨价方案与算力供给。DeepSeek 已实行峰谷分时定价,新一轮整体涨价的幅度与节奏,将直接检验其性价比叙事的成色。而华为昇腾 950 超节点的批量上市进度,决定着 Pro 级别模型的推理供给能否跟上需求。
对行业而言,V4 Pro 正式版的意义在于,前沿 Agent 能力的价格锚点被再次拉低。当逼近第一梯队的性能以百分之一量级的价格供给配资平台问题,中间层模型将最先感受到压力。
配资公司网提示:本文来自互联网,不代表本网站观点。