DeepSWE跃升近5倍:DeepSeek V4 Pro转正兼带涨价预告

DeepSWE跃升近5倍:DeepSeek V4 Pro转正兼带涨价预告

DeepSeek大模型AI AgentAPI定价

数据源:HN + web research

深夜静默无声的正式转正

2026 年 8 月 13 日深夜 23 点,DeepSeek 官方 API 文档的模型页面更新,标识号悄然变更为 DeepSeek-V4-Pro-0813。官方未举行线上发布会,也未在社交平台上进行预热排期。即便如此,此项更新迅速升至 Hacker News 讨论榜首位,获得 692 个点赞与 246 条社区讨论。

这种静默升级策略降低了已有集成的迁移成本。开发者调用接口时无需修改代码逻辑,系统会将 API 请求自动路由至最新的 0813 版本。前期旧模型标识如 deepseek-chatdeepseek-reasoner 已在 7 月末完成清理,各自映射至 Flash 架构的非思考与思考模式。这种静默上线的策略表明 API 服务已具备高可用承载能力,无需通过突发流量来测试系统弹性。

DeepSeek 官方定价页截图 图:DeepSeek 官方「模型 & 价格」页,模型版本已更新为 DeepSeek-V4-Pro-0813。来源:DeepSeek 开放平台

Agent 基准测试反超轻量版本

回顾 V4 系列的发展节点,2026 年 4 月公布 Preview 阶段时,官方同时推出了包含 1.6T 参数的 Pro 版本与 284B 参数的 Flash 版本。但在 7 月 31 日 V4-Flash-0731 率先转正后,轻量版在 Terminal Bench 等基准上曾以 82.7 比 61.8 的成绩压制了旗舰 Preview 版。此次 0813 正式版的释出,重新确立了 Pro 版本在系列内部的性能定位。

评测基准V4 Pro 0813V4 Pro PreviewFable 5
HLE(无工具 / 有工具)42.7 / 60.037.7 / 48.253.3 / 63.0
Terminal Bench 2.187.972.188.0
Cybergym83.352.783.1
DeepSWE62.712.870.0
DSBench-FullStack71.141.8

在官方公布的基准测试数据中,V4 Pro 0813 的 Agent 执行能力增幅明显。其中 DeepSWE 成绩从 Preview 阶段的 12.8 提升至 62.7,Terminal Bench 2.1 从 72.1 增至 87.9,Cybergym 则以 83.3 分反超 Fable 5。DeepSWE 接近五倍的跃升幅度,证明了模型在多步骤长流程代码修复场景下的有效泛化能力。

DeepSeek V4 Pro 0813 官方基准 图:DeepSeek V4 Pro 0813 官方基准(Agent 评测)。来源:DeepSeek 官方发布 / deepseekv4pro.com 整理

当然,上述数据均来自于厂商自测。在 Agent 基准评估中,框架环境(Harness)、提示词格式以及思考推理步数的设定均会对最终分值产生显著影响。在 HLE 等无工具任务或深度代码仓库推理中,该模型距离 Opus 4.8 仍存在客观分差,仍需社区第三方开展无偏见的实测验证。

架构补全与工程落地的未竟事项

工程规格方面,V4 Pro 0813 延续了混合专家(MoE)架构,总参数量达 1.6T,单次推理激活 49B 参数。模型原生支持 1M 上下文窗口,最大单次输出长度为 384K tokens。在能力接入上,正式版补齐了 Responses API 支持,并集成 Anthropic API 兼容层、对话前缀续写与 FIM 代码补全等功能。

尽管 API 接口功能完备,但在官方工具链生态构建上仍存在空白。此前社区期待的自研 Agent 框架 DeepSeek Harness 未能随正式版同步推出,官方文档依然推荐使用 OpenAI Codex、Claude Code 或 OpenClaw 等第三方 Agent 宿主。同时,0813 版本的开源权重是否依照 MIT 协议发布,官方在 API 上线公告中未作明确指示。

1M context 的处理能力配合 384K 输出上限,能够支撑大型项目代码库的整卷索引。然而缺乏配套的官方执行框架,强迫企业开发者自行设计上下文剪裁与状态流转机制。未同步释出官方 Harness 架构意味着企业级开发者仍需自行构建安全沙箱与上下文整理逻辑。

三倍价差背后的商业分层信号

与产品转正同步调整的还有阶梯计费策略。官方定价页面显示,V4 Pro 0813 的输入未命中缓存价格与输出价格分别为每百万 tokens 3.0 元($0.435)与 6.0 元($0.87)。相比 Flash 0731 的 1.0 元与 2.0 元,各项基础资费整整高出三倍。

计费项目V4-Pro-0813V4-Flash-0731
输入·缓存命中0.025 元($0.003625)0.02 元($0.0028)
输入·缓存未命中3.00 元($0.435)1.00 元($0.14)
输出6.00 元($0.87)2.00 元($0.28)
单租户并发上限5002500

除了价格提升之外,并发额度也呈现显著收紧。Pro 版本的单租户并发上限设定为 500,仅为 Flash 版本 2500 并发额度的五分之一。同时,高峰时段继续沿用 2 倍的价格乘数调节。并发限制与三倍价差的组合设定,建立了 Flash 侧重高频规模化调用、Pro 侧重高单价复杂推理的分战路线。

更为明确的信号藏在官方定价页面的英文注释中。官方文字明确指出,计划在近期对 API 服务的整体资费进行向上调整,并预告了较大的涨价幅度。此前 8 月初已有行业媒体披露相关涨价计划,如今官方公告正式验证了这一商业诉求。定价页上的涨价预告与并发限制,标志着通过低价补贴换取高吞吐调用量的阶段正式告终。

API 低价时代收尾与前沿竞争规则

DeepSeek V4 Pro 0813 的转正上线,展示了开源架构前沿模型在 Agent 评测中的工程迭代速度。但这绝非单向的技术能力补强,而是 DeepSeek 加速商业化收割的转型节点。

随着研发成本与计算资源消耗的增加,早期依靠低价 API 跑量扩张的市场策略正在收束。通过 Flash 与 Pro 的分级定价,官方将低成本高并发需求引向轻量模型,将高价值复杂场景留给溢价能力更高的旗舰版本。随之而来的整体涨价计划,将倒逼企业客户重新评估 API 调用的实际投入产出比。

在 API 资费全面走向合理化计价的新阶段,单纯的 Token 价格战正失去吸引力。模型的综合交付质量、长程 Agent 任务的单次成功率以及上下文调优效率,将代替单纯的低价噱头,成为衡量模型服务商核心价值的新指标。

参考链接:

  • DeepSeek API Docs: Models & Pricing
  • DeepSeek V4 Hub: V4 Pro 0813 Arrives With Strong Agent Scores
  • 潮新闻:DeepSeek V4 Pro正式版上线:1M超大上下文+384K输出,价格比Flash贵三倍
  • HN 讨论 (49274600):DeepSeek V4 Pro 0813