DeepSeek V4 Pro 0813 正式版上线:Agent 跑分追平 Fable 5
DeepSeek V4 Pro 0813 正式版上线:Agent 跑分追平 Fable 5 DeepSeek 今天把 V4 Pro 从预览版转成了正式版,模型版本号 DeepSeek-V4-Pro-0813,现已在 DeepSeek API 和OpenRouter上线。 V4 Pro 的参数规格
💡 你将学到
DeepSeek V4 Pro 0813 正式版上线:Agent 跑分追平 Fable 5 DeepSeek 今天把 V4 Pro 从预览版转成了正式版,模型版本号 DeepSeek-V4-Pro-0813,现已在 DeepSeek API 和OpenRouter上线。 V4 Pro 的参数规格
DeepSeek V4 Pro 0813 正式版上线:Agent 跑分追平 Fable 5
DeepSeek 今天把 V4 Pro 从预览版转成了正式版,模型版本号 DeepSeek-V4-Pro-0813,现已在 DeepSeek API 和OpenRouter上线。
V4 Pro 的参数规格早就不是秘密,总参数 1.6 万亿(MoE 混合专家架构),每个 token 激活参数量 49 亿,上下文窗口 100 万 token,最大输出 38.4 万 token,预训练数据 32 万亿 token。这套架构沿用了 4 月预览版的规格,没有大改。
关键变化在 Agent 能力
DeepSeek 官方对比表里给出了 9 项 Agent 基准测试,V4-Pro-0813 平均只落后 Claude Fable 5 2.8%,其中 2 项还反超。这是 DeepSeek 第一次把自己的旗舰模型跟 Fable 这种顶级闭源模型摆在同一张表上对比。
具体看几个核心跑分
Terminal Bench 2.1 打到 87.9(终端操作能力),比预览版的 72.1 涨了 15.8 分。Cybergym 升到 83.3(网络安全),比预览版涨 30.6。DeepSWE 从 12.8 涨到 62.7(软件工程),涨了 49.9 分。这条涨幅最大,也是这次转正的核心叙事。官方的话术也变了,从 Preview 时期的"更会答题"换成了"更会把一件事干完",DeepSWE 测的就是 AI 能不能像工程师一样持续干活。
跑分涨归涨,落到用户手里感知是什么?
你马上能体会到的进步是,这次升级让几件之前 AIagent 干不好的事能干了。一是长任务不烂尾。之前用 V4 Pro 预览版写一个完整项目,往往写完一个文件就要重新描述上下文,V4 Pro 0813 能把整个仓库一次性读完再下手,多步任务中段保持连贯。二是工具调用更稳。之前让 AI 帮我跑命令、改文件、再跑命令,中间经常在某一步卡住,V4 Pro 0813 能把这种五步以上的工具链跑完不再翻车。三是出错能自己救。让 AI 写一段代码,编译报错,之前的版本经常停下来问"要不要继续",V4 Pro 0813 会自己读报错信息、改代码、再编译,整个回环走完才回报。
这些变化加起来就是一条,AI 往"能交付的同事"走了一大步。DeepSWE 12.8 到 62.7 的跑分,背后是这一类工程场景的能力质变。
价格是另一张牌
V4 Pro 正式版定价(每 1M tokens),缓存命中输入 0.025 元、缓存未命中输入 3 元、输出 6 元。相比之下 V4-Flash 是 0.02 元、1 元、2 元。V4 Pro 比 Flash 贵了 3-6 倍,但跟 Fable 5 比是另一种画风。Fable 5 混合费率 30 美元/百万 tokens,V4 Pro 折算下来约 0.65 美元,价差是 45 倍。性能差 2.8%,价格差 45 倍,这就是 DeepSeek 的算账方式。
架构上的支撑来自两点
V4 Pro 用了两种注意力变体,压缩稀疏注意力(CSA)和重度压缩注意力(HCA),单 token 推理 FLOPs 降到 V3.2 代的 27%,KV 缓存占用降到原来的 10%。100 万 token 上下文窗口的推理成本被这两个机制压下来,才给了定价空间。
API 这次也做了兼容性升级
V4 Pro 同时支持 OpenAI 和 Anthropic 两种接口格式,调用方法不变,开发者用 deepseek-v4-pro 或 deepseek-v4-flash 就能切到最新版本。已经在 Claude Code、OpenClaw、OpenCode、CodeBuddy 这类 Agent 框架里开发的,直接换 base_url 就能用。三档推理模式也开了,普通模式、高推理、最高推理(V4 Pro Max),后者是首次出现。
权重目前还是 API 先跑、权重后放的开源节奏。V4-Flash 是 7 月 31 日转正、随后放出权重,V4 Pro 应该也是这个路子。
今天 AI 圈这边热闹的不只是 DeepSeek。xAI 在 DeepSeek V4 Pro 上线几分钟后,紧接着在自家 API 上推出了 Grok 4.6,同价 $2/$6,Artificial Analysis 给出的 Intelligence Index 61 分,跟 GPT-5.6 Sol Max 持平。Cursor 和 Grok Build 当天直接接入。Qwen 3.8 Max 也在今天开源。三家几乎同时发新模型,这事不常见。
本站文章由编辑人工撰写,收录的工具均经过实测或公开资料核验。文中链接指向工具官网或 GitHub 仓库,仅作信息参考,不构成付费推广。
