PD虚拟机     VPS     Win11     微软     苹果     SetApp     Office     精选

DeepSeek V4 Pro 正式版!国产开源 AI 战力天花板 (直逼 Fable5 / 价格便宜 30 倍)

王炸升级  人工智能    , , ,    2026-08-13
DeepSeek V4 Pro 正式版!国产开源 AI 战力天花板 (直逼 Fable5 / 价格便宜 30 倍)
5 下载

今天一大消息就是开源 AI 大模型圈的“卷王” DeepSeek,憋了好长的时间之后,终于把全新系列模型 DeepSeek-V4 Pro 正式版发布出来了,而且照惯例,同步开源!

现在 DeepSeek 官网和 API 都直接能用 v4 Pro / Flash 正式版了!相信 众多第三方算力平台WorkBuddy 也将陆续跟进上线。之前 ClaudeChatGPTGeminiQwen 等行业里各家一直在疯狂迭代。而有着“国产 Ai 图腾”、价格屠夫之称的 DeepSeek 终于又出来炸一回场了……

便宜 AI 模型 API 中转站

第三方 API 算力平台


访问:DeepSeek 官网

ChatWise 通用 AI 客户端

DeepSeek-V4 依然价格屠夫!干翻 GPT 5.6 和 Claude Fable 5

现在通过 DeepSeek 官网或 七牛云SophNet 等一些第三方 API 算力平台 应该很快都能用到最新的 DeepSeek-V4 正式版模型了。这次 V4 Pro 不单只是参数上的常规升级,还有工具调用能力、百万 Token 上下文Codex 等 AI Agent 接口的适配、支持 Response API 格式等等。

DeepSeek V4 大模型

工具调用能力 + 百万 Token 上下文 = Agent 干活能力直线飙升!先说 1M Token 上下文,换算成中文,能吞下约 75 万字,相当于能一口气啃下完整的《三体全集》三部曲!得益于此,DeepSeek 正式版不再“忘事”,现在明显能干更耗时的长活了。

以前大家评价一个模型,容易盯着问答、写作、数学题、编程;但现在真正拉开差距的,还有一个是:AI 能不能调用工具、读懂代码库、执行终端命令、连续完成多步骤任务。换句话说,AI 不只是陪你聊天,而是能不能真的拉起袖子直接去做事。

DeepSeek V4 Pro 正式版的重点,正是 Agent 能力的大幅增强。尤其对于写代码、修 Bug、自动化处理数据、搭建工作流、批量任务的人来说,这次升级有点“鸟枪换炮”的意思。那些需要长期记忆、复杂规划的 Agent 任务,终于可以踏实放心地长时间跑了。

DeepSeek-V4 Pro 与 Flash 两大模型

DeepSeek-V4-Pro 正式版

DeepSeek-V4-Pro:是一款面向复杂任务的旗舰模型,尤其适合开发者、AI 产品团队、自动化工作流搭建者,以及需要处理大量文本和代码的企业用户。

它采用 MoE (混合专家模型) 架构,总参数量约 1.6 万亿,但每次推理只激活约 490 亿参数。简单理解,就是模型“脑子”很大,但每次做题只调动最相关的一部分能力,在性能和成本之间找平衡。支持 1M Token 上下文窗口,最高可输出 384K Token。这对以下场景很实用:

  • 把大型代码仓库、长日志、需求文档一次性放进上下文分析
  • 做跨文件代码重构、Bug 修复、代码审查
  • 批量处理企业知识库、合同、研报、客服记录
  • 让 Agent 连续调用工具,完成多步骤自动化任务
  • 生成长文档、复杂代码、结构化数据

同时,它支持 JSON OutputTool CallsResponses API,并兼容 OpenAI 和 Anthropic 两套 API 格式。对于已经使用 CodexClaude Code、OpenCode 等工具链的开发者来说,迁移成本会低不少。

值得一提的是,正式版还官方支持 Codex 接入。对于习惯在 VS Code、Codex 命令行里写代码的人,这一点很关键,配置好 API 后就能把 DeepSeek V4 Pro 当作后端模型使用。

DeepSeek-V4-Flash

DeepSeek-V4-Flash:更快捷高效的经济之选。总参数 284B,激活参数 13B。

  • 相比 Pro 版本,它在世界知识储备方面稍逊一筹,但展现出了非常接近的推理能力。
  • 由于模型参数和激活更小,它能提供更加快捷、经济的 API 服务。
  • 在 Agent 测评中,简单任务上可以和 Pro 旗鼓相当,高难度任务上才有差距。
  • 千万别把它当成“丐版”! 选对了思考模式, Flash 的表现能大幅追近 Pro。日常轻量任务用 Flash,性价比超高;遇到硬骨头任务,打开它的 Think Max 模式,性能提升非常显著。

V4 Pro 跑分测试:开源模型天花板,逼近史诗级 Fable 5!

这次 DeepSeek V4 Pro 正式版让人震撼的,莫过于它在各大基准测试中的爆表表现。官方群顺手甩出来的那张评测对比图,是这次所有讨论的起点。几个数字的跳变相当吓人:

  • Terminal Bench 2.1 (让模型自己进终端跑完整任务) :预览版 72.1 → 正式版 87.9,距离 Anthropic 旗舰 Fable 5 的 88.0 只差 0.1 分
  • DeepSWE (模拟真实软件工程,从理解代码库到提交 PR) :12.8 → 62.7,涨了接近 5 倍
  • DSBench-Hard (高难度全栈开发) :31.1 → 67.2,翻了一倍还多
  • CyberGym (网络安全攻防) :52.7 → 83.3,直接反超 Fable 5 的 83.1
  • AutomationBench (工作流自动化) :12.8 → 31.8,同样压过 Fable 5 的 29.1
  • Toolathlon-Verified (工具调用验证) :55.9 → 74.1

横向对比的话,V4 Pro 正式版在 Terminal Bench 上已经超过 Opus 4.8 的 85.0,开了工具之后的 HLE (人类水平评估) 拿到 60.0,也把 Opus 4.8 的 57.9 甩在身后。短板当然也还在:不带工具的纯知识推理 HLE 只有 42.7 (Fable 5 是 53.3) ,Toolathlon-Verified 也还差 Claude Fable 5 几分。

所以官方定位也很准确:这是“准 Fable 级,不是 Fable 级”。最难的纯推理和复杂工具链场景,它和顶级闭源还有几步距离;但只要给工具、让它真操作环境,它已经能跟全球第一掰手腕了。

1.6 万亿参数的"冰山"

DeepSeek V4 Pro 是 MoE (混合专家) 架构,总参数 1.6 万亿,但每次推理只激活约 490 亿参数——相当于养了一支 1.6 万人的专家团队,每次会诊只叫最懂行的 490 个精英过来,质量有保证,但工资却能省下一大截。

DeepSeek V4 大模型

接口规格更是为“干活”准备的:100 万 Token 上下文窗口,最高 38.4 万 Token 单次输出,支持思考和非思考双模式。1M 上下文意味着什么?一个中型代码仓库可以直接整个塞进去做跨文件重构,几十份长文档、连续几十步的工具调用都不会把上下文撑爆,Agent 再也不用边干边"失忆"。

另外,正式版还首次原生支持了图像推理,DeepThink 引擎可以在同一个思考流程里分析截图、解读图表、处理图文混排的文档,对需要看图干活的 Agent 场景来说,算是从 0 到 1 的突破。

专为 Agent 任务优化!这才是升级的主角

把上面这些数字连起来看,核心信号只有一个:DeepSeek 把后训练 (Post-training) 的重点,从“答得更准”转移到了“干得更稳”。

DeepSeek V4 大模型

DeepSWE 从 12.8 涨到 62.7,测的不是“会不会写一段代码”,而是“能不能像工程师一样持续干活,不断解决遇到的问题”——理解项目结构、定位 Bug、跨文件修改、最后把 PR 交出去。这种长链路任务恰恰是预览版最容易翻车的地方。配合 Codeforces 竞技编程 3206 分 (人类前 23%) 、LiveCodeBench 93.5 分登顶,V4 Pro 正式版的编程能力已经摸到了全球第一梯队。

更有意思的是,这次升级没有动架构和参数量,纯粹靠后训练管线的调优就实现了"同架构、大提升"。这给行业提了个醒:模型规模卷到一定量级之后,在训练方法上深耕,性价比可能比盲目堆参数还高。

依旧是熟悉的“价格屠夫”,这次继续卷!

性能追上来,价格怎么样?DeepSeek 果然不负“价格屠夫”之名,这次定价简直让人怀疑他们是不是在倒贴。

DeepSeek V4 正式版价格:

模型输入 (缓存命中)输入 (缓存未命中)输出上下文
V4 Flash 正式版 (空闲时段)0.05 元 / M tokens1.5 元 / M tokens4.5 元 / M tokens1M
V4 Flash 正式版 (高峰时段)0.10 元 / M tokens3.0 元 / M tokens9.0 元 / M tokens1M
V4 Pro 正式版 (空闲时段)0.15 元 / M tokens4.5 元 / M tokens13.5 元 / M tokens1M
V4 Pro 正式版 (高峰时段)0.30 元 / M tokens9.0 元 / M tokens27.0 元 / M tokens1M

横向对比业界

横向对比业界(换算为美元,按常见 3:1 输入输出混合费率估算,1 USD = 6.75 CNY):

模型每百万 tokens 综合成本 (USD)相对 V4-Pro
DeepSeek V4-Flash(空闲)~$0.560.34 倍
DeepSeek V4-Flash(高峰)~$1.110.67 倍
DeepSeek V4-Pro(空闲)~$1.671 倍
DeepSeek V4-Pro(高峰)~$3.332.00 倍
GPT-5.x$10~$30约 6~18 倍
Claude Opus 4.x~$15约 9 倍
Claude Fable 5~$50约 30 倍

这差价,看得我下巴都惊掉了!对于做 Agent 产品、需要大量调用 API 的开发者来说,这意味着月账单可能直接从“烧钱”变成“能跑出正毛利”。这功能太卷了,真的卷得太狠了!

怎么用?立刻就能上手!

说了这么多,怎么体验这个“卷王”?

  • 普通用户:直接登录 DeepSeek 官网,或下载 APP。现在就能跟最新的 V4 对话,感受百万上下文。在官网或 App 里,专家模式对应 V4 Pro,快速模式对应 V4 Flash。
  • 开发者:官网API 已同步上线,无缝兼容!七牛云SophNet 等众多第三方 API 算力提供商也会陆续上线,基本上只需修改 base_url 即可。
    • OpenAI ChatCompletions、Response 接口和 Anthropic 接口都支持。
    • 调用时,只需把 model 参数改为 deepseek-v4-prodeepseek-v4-flash
    • 对于复杂 Agent 场景,建议使用思考模式,并通过 reasoning_effort 参数设置思考强度为 max
  • 研究者 / 本地部署:模型权重已同步开源
    • 可在 Hugging Face 或 ModelScope 下载。
    • 技术报告也已公布,地址在 Hugging Face。

写在最后

DeepSeek V4 Pro 正式版最重要的变化,不是简单地升级参数量,也不只是跑分变高,而是它明显在往“执行型 AI”靠拢。以前模型会不会答题很重要,现在能不能干更重要。

你只需给它一个完整的代码库、一堆文档和几个工具,它就能把复杂任务拆解、一路推进到交付结果。V4 Pro 在 Agent 能力上已经飙升到开源天花板级别,达到“准 Fable5”能力!加上价格依然是“屠夫”的低廉,真的能让所有人都能用爽,也能更好推动行业往前走……

相关文件下载地址

官方网站:访问
软件性质:免费开源
更多 AI 相关:ChatGPT  |  Claude  |  Gemini  |  Qwen  |  Grok  |  Kimi
通用 AI 模型 API 客户端:ChatWise  |  Cherry Studio (桌面版)  |  ChatBox (电脑手机)
更多:第三方 DeepSeek API 服务推荐  |  低价 AI 中转站推荐

访问 DeepSeek 网页版  |  下载 DeepSeek 手机应用 iOS  |  Android  |  更多 AI 相关

/ 关注 “异次元软件世界” 微信公众号,获取最新软件推送 /

  • iplaysoft小粉

    X大人能不能出一个本地部署AI智能体的教程呀。

     - 18:21
·····
展开后面 4 条历史评论





评论内容 (*必填):
Ctrl + Enter 快速提交   

赞赏异次元


请通过支付宝、微信 APP 扫一扫,海外读者可「使用 PayPal 赞赏

“ 感谢您对异次元网站的支持! ”