DeepSeek 以 docs 切流方式上线旗舰 V4-Pro-0813:1.6T 参数 MoE、1M 上下文,API 定价 $0.435/$0.87 每百万 token
DeepSeek 于 8 月 12 日以 docs 级切流方式上线旗舰模型 V4-Pro-0813(无正式公告):1.6T 总参数、49B 激活参数的 MoE 架构,混合注意力,三种推理模式,1,048,576 token 上下文窗口,最大输出 384,000 token。OpenRouter、Together AI、LMMarketCap 同步上架,API 定价 $0.435/百万输入、$0.87/百万输出 token。wccftech 报道 DeepSeek 的 token 消耗量持续攀升,模型已在其 API 与 Chat 产品中滚动部署。
事件与背景
2026 年 8 月 12 日,DeepSeek 以文档切流(docs-level cutover)方式上线旗舰模型 V4-Pro-0813:官方没有发布公告或 changelog,但 api-docs.deepseek.com 定价页已列出该版本号,OpenRouter、Together AI、LMMarketCap 等第三方平台同日上架独立模型 ID。digitalapplied 观察到「价格表先于公告出现」——首页横幅仍显示旧版,定价页已切换到 V4-Pro-0813,这是 DeepSeek 第二次用「先切流、后解释」的方式发布模型。
关键事实
| 项目 | 详情 |
|---|---|
| 模型 ID | DeepSeek-V4-Pro-0813(docs 切流,无正式公告) |
| 架构 | 1.6T 总参数 MoE,49B 激活参数,混合注意力 |
| 上下文 | 1,048,576 token(1M),最大输出 384,000 token |
| 推理模式 | 三种(thinking / non-thinking 等,平台页交叉一致) |
| API 定价 | $0.435/百万输入、$0.87/百万输出 token |
| 上架平台 | OpenRouter、Together AI、LMMarketCap 等同步 |
| 部署状态 | wccftech:token 消耗量攀升,API 与 Chat 滚动部署 |
技术机制或行业解释
V4-Pro-0813 的关键不是参数总量,而是「激活参数 + 上下文长度 + 定价」三者的组合。49B 激活参数意味着每次推理的算力开销远低于 1.6T 总量,这是 MoE 摊薄成本的基础;1M 上下文把整本书或整库文档塞进单次推理成为现实;而 $0.435/$0.87 的定价把长上下文成本压到此前旗舰模型的零头。与 Grok 4.6 的 $2/$6 相比,DeepSeek 在同等量级上下文下价格低 4~7 倍,形成了明确的价格锚点。
影响与意义
对 RAG 与长文档 Agent 架构,1M 上下文 + 低价意味着「全部喂进去」的检索方案在经济性上首次可与「先检索再合成」竞争,长上下文不再是少数玩家的奢侈品。对中国 AI 生态,docs cutover 发布模式绕过了传统公告与评测节奏,把「可调用」作为发布信号,可能推动行业把「API 可用」而非「博客发布」当作模型 GA 的事实标准。对成本敏感的开发者,DeepSeek 定价成为长上下文推理的预算下限参考。
风险与边界
官方未发正式博客,事件日期与参数来自 OpenRouter、Together AI、LMMarketCap 三平台交叉一致 + wccftech 二手报道,web_extract 被拦未深读 DeepSeek 官方定价页原文;「GA」判断基于平台状态,DeepSeek 官方口径未确认;参数量与定价细节仍以官方定价页为准;与 Grok 4.6 的价格对比基于公开 API 定价,实际折扣与批量价未计入。
后续观察
关注 DeepSeek 是否发布正式博客或 changelog 确认 V4-Pro-0813;跟踪 1M 上下文在真实 RAG 场景中的采纳率与成本案例;对比 OpenAI/Anthropic/Google 是否跟进降价;观察「docs 切流发布」是否成为 DeepSeek 的固定发布模式,以及 HF 权重是否随后开放。
AI Master 解读
核心事件
DeepSeek 8/12 以 docs-level cutover(无官方博客)上线旗舰模型 V4-Pro-0813:1.6T MoE(49B 激活)、1M 上下文、$0.435/$0.87 每百万 token。
行业影响
与 news-6583(7/31 V4-Flash 轻量正式版)构成系列:V4-Flash 是轻量通道,V4-Pro-0813 是旗舰 GA,兑现了 news-6587 注释「V4 Pro 8 月初跟进」的预期。与 Grok 4.6($2/$6 每百万 token,已转 FULL 长文通道)对照可形成「中美价格战双轨」:DeepSeek 用约 1/4~1/7 的价格提供同等量级的上下文能力。
AI Master 建议
评估 1M 上下文 + 低价组合对 RAG/长文档 Agent 架构选型的影响;关注 docs cutover「无公告发布」模式对中国开源生态发布纪律的意义;把 DeepSeek 定价作为长上下文推理成本的下限基准。
