深夜悄悄上线!DeepSeek V4 Pro 正式版,多项测试逼近 Claude

深夜悄悄上线!DeepSeek V4 Pro 正式版,多项测试逼近 Claude

大模型圈这两天注定不平静。就在 8 月 12 日深夜,DeepSeek 官网的 API 文档里悄悄多了一个版本号:DeepSeek-V4-Pro-0813。没有发布会、没有高调官宣,新一代旗舰模型就这么上线了——但懂行的人都知道,这是一次值得关注的产品升级。消息传出后,从开发者社区到科技媒体,讨论热度一路走高,很多人的第一反应都是:DeepSeek 又偷偷憋了个大招。

深夜上线的旗舰模型

据 DeepSeek 官网 API 文档显示,DeepSeek-V4-Pro 对应模型已从此前的预览版切换为正式版(版本号 0813),并开始通过 API 灰度提供服务。目前官方尚未发布完整的更新日志,但 API 端已经可以调用新模型,官方”模型与价格”页面也明确标注了新的版本号。这种”先上线、后官宣”的低调打法,本身就是 DeepSeek 一贯的风格——用产品说话,而不是用发布会。

对开发者来说,这则消息意味着可以直接在 API 里切到新版模型实测了。从社区反馈看,很多人已经在第一时间跑了基准和业务场景测试,整体评价是:相比预览版,正式版的稳定性和智能体任务完成度都有明显提升。

几个关键数字

  • 100 万 Token 上下文:支持超长文本处理。这意味着你可以把一整本书、一大份代码仓库直接丢给它,长文档分析、大规模代码审查这类场景从”勉强能用”变成了”真正可用”。
  • 最高 384K 输出:单次生成能力大幅提升。写长报告、生成完整项目文件、一次跑完复杂任务,都不需要再频繁拼接输出。
  • 双模式:兼容思考模式与非思考模式。需要严谨推理的任务开思考模式,追求速度和成本的任务用非思考模式,按需切换。
  • Agent 能力全开:支持 JSON Output、Tool Calls、Responses API、Anthropic API 兼容等主流智能体开发能力。对做 Agent 应用的开发者来说,这些接口直接决定了能多快地接入自己的系统。

性能逼近国际顶流

多家科技媒体援引 DeepSeek 官方群流传的评测数据显示,新版 V4 Pro 在多项智能体测试中的表现已经逼近 Anthropic 的 Claude Fable 5,部分项目甚至超过 Fable 5;相比此前的预览版,整体能力提升明显。尤其值得关注的是智能体相关测试——与传统大模型主要考察知识问答、数学推理不同,智能体测试更接近 AI”真正干活”的能力:能否调用工具、执行多步骤任务、编写和修改代码、持续推进复杂工作。

需要说明的是,这些具体分数目前仍属于非官方披露数据(来自官方群和社区流传),最终成绩要以 DeepSeek 正式发布的基准为准。但这并不妨碍一个判断:DeepSeek 在 Agent 方向上的积累,正在通过后训练和工程优化转化为实实在在的任务执行能力。

价格暂时没涨,但涨价已在路上

目前 V4 Pro 的 API 定价为:输入 3 元/百万 Token、输出 6 元/百万 Token,缓存命中状态下输入低至 0.025 元/百万 Token——延续了 DeepSeek 一贯的低价策略。但 DeepSeek 官网已经明确预告:”我们计划在不久的将来上调 DeepSeek API 服务的整体价格,预计涨幅较大。”

这意味着当前是”能力升级、价格未动”的窗口期。对开发者和重度用户来说,现在接入新模型、跑通业务流程、验证效果,是最划算的时机;等涨价落地后再迁移,成本和不确定性都会更高。有媒体分析认为,这更像是 DeepSeek 在涨价之前的一次”性能升级 + 产品切换”:先把新模型推向 API 用户,再根据算力供给和调用量调整价格。

为什么说这比跑分更重要

相比单纯的性能数字,V4 Pro 更值得关注的是 DeepSeek 的竞争策略:把重心押在 Agent 和编程场景,接口尽量兼容主流生态(Responses API、Anthropic API),方便开发者低成本迁移。这释放了一个清晰的信号——国产模型的竞争焦点,正在从”谁跑分高”转向”谁更能干活、谁更便宜”。

回顾 DeepSeek 的节奏:4 月发布 V4 预览版时强调 Agentic Coding 达到当时开源领先水平;7 月 31 日 V4 Flash 正式版上线,明确披露智能体能力大幅增强(Terminal Bench 2.1 达到 82.7 等);如今 V4 Pro 正式版继续向 Fable 5 靠拢。一条清晰的升级线:模型越来越强,价格越来越低,Agent 能力越来越重。

给普通用户的一句话

如果你在用 DeepSeek 处理日常任务,V4 Pro 正式版带来的是更强的长文本和智能体能力——写长文档、做深度分析、处理大代码库,体验都会有明显升级;如果你是开发者,现在是迁移和测试新模型的好时机——在涨价之前,把新能力用起来、跑通流程,未来就能以更低成本持续使用。

你会把 DeepSeek 用在什么场景?评论区聊聊你的使用心得。

游客头像

龙主编

龙主编,AI智习室官方媒体主编。 专注 AI 行业观察与实操分享,擅长将复杂技术转化为通俗易懂的实战指南。 坚信 AI 不是取代人类,而是赋能每个人。 内容风格: 真实案例 + 详细干货 + 可操作性 使命: 让普通人也能抓住 AI 时代的红利。

发表评论