AGI Daily
广告
AGI Daily跟踪世界 AGI 进展AGI INTELLIGENCE · DAILY
全部算力算法数据人物日报主题
AGI Daily
全部算力算法数据人物日报主题
广告

DeepSeek V4 Pro 静默切到 0813:没有公告、没有基准表、没有权重

2026-08-12 / 2 天前 · 共 2,166 字

模型

8 月 12 日,DeepSeek 的旗舰 API deepseek-v4-pro 在没有发布任何公告的情况下,被切到了新构建 DeepSeek-V4-Pro-0813。最直接的证据藏在官方文档里:定价页的「MODEL VERSION」栏显示为 DeepSeek-V4-Pro-0813。没有 changelog 条目,没有新闻稿,没有官方 X 帖,也没有权重发布。

一次文档级的切换,不是一场发布

DeepSeek 的 Change Log 最新一条仍停在 7 月 31 日的 V4 Flash 更新。那篇 changelog 明确写着:「DeepSeek-V4-Pro API 与 APP/WEB 模型保持不变,V4 Pro 的正式发布将随后到来。」两周后,这次「正式发布」似乎到了——但它只改了文档里的版本号。

第三方目录与评测页记录了这一时刻:OpenRouter 在 8 月 12 日上线了带日期的 deepseek/deepseek-v4-pro-0813 路由(canonical snapshot 为 deepseek-v4-pro-20260813),同时保留了一条明显更贵的滚动 Pro 路由(输入 $1.168、输出 $2.336);独立评测页 Vorp Labs 在同日核查中确认滚动 ID 已指向 0813,且快照名指向 8 月 13 日北京时间的构建。

对已经在调用 deepseek-v4-pro 的开发者,这意味着他们手中的模型在没有任何通知的情况下被换掉了。Vorp Labs 给出的处理建议很直接:把这个切换当作「真实但缺乏文档」的事件,对回归敏感的工作负载立即重跑验收,而不是等到官方补发公告。

规格与价格几乎没变,除了那条涨价的注脚

0813 没有披露任何架构变化。4 月预览版公布的 1.6T 总参数 / 49B 激活参数口径是否仍成立,DeepSeek 未作说明;定价页列出的服务规格仍是 1M 上下文、384K 最大输出、并发上限 500(V4 Flash 为 2500),支持 thinking / non-thinking 双模式、JSON 输出、工具调用、Responses API 与 Anthropic API。

价格同样未变:缓存命中输入 $0.003625、缓存未命中输入 $0.435、输出 $0.87(每百万 token)。但定价页脚注写明:「我们计划在近期整体上调 DeepSeek API 价格,预计涨幅显著。」这条警告没有数字、没有生效日期,意味着任何基于当前价格表的成本模型都有已知的过期风险。对长会话 Agent 工作负载,真正起决定作用的是缓存命中与未命中之间约 120 倍的价差,以及 thinking 模式默认开启后推理 token 按 $0.87 计入输出。

基准真空:流传的数字标注为「官方」,但查无实据

模型换了,DeepSeek 却没有给出任何基准表——英文 API 文档与 changelog 里都找不到 0813 的评测数据。信息真空在数小时内被第三方填满:X 账号 @DanDr1s 在 8 月 12 日发布表格,称其为「DeepSeek V4 Pro 的官方基准」,显示 Agent 基准相对预览版大幅跃升——Terminal Bench 2.1 从 72.1 升到 87.9、CyberGym 从 52.7 升到 83.3、DeepSWE 从 12.8 升到 62.7、AutomationBench 从 12.8 升到 31.8、DSBench-Hard 从 31.1 升到 67.2。

这些数字无法在 DeepSeek 公开的英文文档中核实。一个关键背景是:7 月 31 日的 changelog 披露,V4 Flash 0731 的官方评测使用「DeepSeek Harness minimal mode(即将发布)」作为框架;而 Vorp Labs 在 8 月 12 日的核查中指出,截至当时「没有任何厂商发布的 0813 基准」,社区流传的数字「方法论未作说明」。也就是说,即使这些数字确实出自官方渠道,外界目前也没有可用的官方框架去复核或复现。

唯一可核实的官方基线来自那篇 7 月 31 日的 changelog:V4 Flash 0731 的 Agent 基准「远超 V4-Pro-Preview」。在 DeepSeek 自己的口径里,284B / 13B 激活的 Flash 已经在 Agent 任务上压过了 1.6T / 49B 的 Pro 预览版。这正是 0813 需要回答、却始终没有回答的问题:Pro 的正式版到底比 Flash 强多少。

静默更新说明了什么

DeepSeek 不是不会发公告。V4 Flash 0731 有完整的 changelog 条目和基准表,4 月的 V4 系列有正式新闻稿和权重发布。Pro 0813 的静默因此更像是有意为之:在滚动 API ID 之下,「发布」被降格为一次无需用户迁移的部署动作。

这次静默留下三个未回答的问题。权重:V4 Flash 0731 在发布当天就上线了权重仓库,而 Pro 0813 至今没有,自托管者仍只能拿到 4 月的预览版(MIT 许可)。价格:官方预告的大幅涨价没有数字和日期,当前 $0.435 / $0.87 的价格表随时可能失效。评测:官方没有基准、harness 未公开,流传的「官方」数字既无法核对方法论,也无法独立复现。

接下来看什么

三个可观察的变量决定了这次「发布」的最终形态:DeepSeek 是否补发 changelog 或新闻稿;0813 权重是否出现在 Hugging Face——这决定它是否延续「发布即开源」的惯例;以及涨价公告的生效日期与幅度。在这些信号出现之前,把 0813 当成一次「真实但未经说明」的模型变更,比把它当成一次已经完成的发布更稳妥。

来源

  1. DeepSeek Models & Pricing · DeepSeek
  2. DeepSeek API Change Log · DeepSeek
  3. DeepSeek V4 Preview Release · DeepSeek
  4. DeepSeek V4 Pro model release review · Vorp Labs
  5. DeepSeek V4 Pro 0813 (OpenRouter) · OpenRouter
  6. DeepSeek V4 Pro 0813 quietly released (Hacker News) · Hacker News
  7. @DanDr1s: DeepSeek V4 Pro's official benchmarks (X) · X

评论

登录后即可参与评论。

加载评论中…

相关文章

  • 微软 Copilot 的动画角色 Mico,本次将从 Copilot Voice 中移除并迁往 Learn Live

    微软合并 Copilot 应用、下线五个功能,Deep Research 改为付费项

    算法 · 2026-08-13

  • X 应用设置中的 Under the Hood 透明度工具截图,展示可下载账户与帖子排序标签 JSON 数据的功能

    X 开源推荐排序代码,违规判定仍留在黑箱里

    算法 · 2026-08-13

  • 该预印本的泛化热力图,展示训练后的说服者对不同目标模型在五个基准数据集上的说服成功率

    一条假论点让 LLM 放弃正确答案:RL 说服者把准确率从 66% 降到 1.8%

    算法 · 2026-08-13

  • Anthropic 地盘战实验的结局分布图:Mythos 5 约 98% 的试验以停战告终,而 Sonnet 4.6 与 Opus 4.6 多数以武力解决或悬而未决

    更强的模型不会自动带来协调:Anthropic 的多智能体失败实验

    算法 · 2026-08-13

  • 智能手机屏幕上 Google Gemini 应用图标的特写照片

    Gemini 月活破 10 亿,但与 ChatGPT 的 10 亿是两个口径

    算法 · 2026-08-12

  • Grok 4.6 官方发布主视觉图

    Grok 4.6 追平 GPT-5.6 Sol,输出价格只有五分之一

    算法 · 2026-08-12

AGIDaily跟踪世界 AGI 进展© 2026 AGIDaily
关于邮件栏目主题定制投稿招聘广告SkillTermsContactRSS