今天,DeepSeek-V4,终于来了。
预览版正式上线并同步开源。
一共放了两个版本,
DeepSeek-V4-Pro和DeepSeek-V4-Flash,
都支持1M上下文,官网、App、API 同步更新。

Pro主打顶级性能,Flash 主打更小、更快、更便宜。
两个版本都同时支持非思考模式和思考模式,
思考模式还能调 reasoning_effort,复杂 Agent 场景建议直接上 max。
旧的deepseek-chat和deepseek-reasoner也给了三个月迁移窗口。
V4-Pro,性能比肩顶级闭源模型。
官方给出的判断有三条:

1. Agent能力大幅提高:
相比前代明显往前走了一大步,
尤其是Agentic Coding这类任务,已经摸到了当前开源模型里的最好水平,在其他几个Agent相关评测上也都很能打。
官方给的内部反馈也挺直接,现在DeepSeek内部员工已经把它当成日常使用的Agentic Coding模型了,
使用体验比Sonnet 4.5更好,交付质量大致接近Opus 4.6的非思考模式,不过和Opus 4.6的思考模式相比,还是有一点距离。
2. 丰富的世界知识:
DeepSeek-V4-Pro在世界知识测评中,大幅领先其他开源模型,仅稍逊于顶尖闭源模型Gemini-Pro-3.1。
3. 世界顶级推理性能:
在数学、STEM、竞赛型代码的测评中,
DeepSeek-V4-Pro超越当前所有已公开评测的开源模型,
取得了比肩世界顶级闭源模型的优异成绩。

不过如果只看这些话,很容易还是掉进那种老问题里,强是强,然后呢。
先说最直接的一层,百万上下文。

这件事非常关键。
一年前,1M上下文还是少数模型拿来立人设的高端功能。
今天DeepSeek直接把它做成了所有官方服务的标配,而且还开源。
它不是说我们也有百万上下文了,它是在把百万上下文这件事往普惠、往基础设施那边推。
官方对这件事的解释也很明确,V4开创了一种新的注意力机制,在token维度做压缩,再结合DSA稀疏注意力,把长上下文的计算和显存成本压了下来。
这不是一个小修小补的升级。
因为今天做 Agent、做代码仓库处理、做长文档分析、做复杂工作流,最怕的就是上下文不够。
你一旦接到真实业务,文档、日志、历史消息、工具返回、文件树结构,全都要往里塞。
上下文窗口不够,很多工作流根本搭不起来。
所以V4把1M上下文从王牌做成标配,
这件事比单纯多几分benchmark更有实际意义。
它是在把一类原本只有少数模型能玩的能力,往真正可用的方向上推。
然后是 Agent。
V4针对Claude Code、OpenClaw、OpenCode、CodeBuddy等主流的Agent产品进行了适配和优化,在代码任务、文档生成任务等方面表现均有提升。

上下滑动
V4-Pro 在某 Agent 框架下生成的 PPT 内页示例
再说价格。
目前,DeepSeek API已同步上线V4-Pro与V4-Flash,
支持OpenAI ChatCompletions接口与Anthropic接口。
访问新模型时,
base_url不变, model参数需要改为deepseek-v4-pro或deepseek-v4-flash。

V4-Pro现在是输入12元人民币每百万tokens,输出24元。
V4-Flash是输入1元,输出2元。
这个价格和大家印象里的DeepSeek比,当然不算那种一出场就掀桌子的价格屠夫了。
但如果放到今天的市场环境里看,尤其是和很多海外头部模型对比,它还是有非常强的吸引力。
更重要的是,Flash不是一个拿来凑数的版本,
它是真的能跑任务、能顶简单Agent工作流、还能拿到1M上下文的经济版。
还有一个重点,就是国产算力这条线。
这件事官方发布稿里没有把所有细节摊开说透,但外部信号已经很明显了。

Reuters直接写到,DeepSeek这次的新模型已经适配华为 Ascend芯片技术,
华为也宣布,基于Ascend 950的supernode会完全支持V4。
Reuters给出的判断也很直白,这代表DeepSeek正在从过去更依赖英伟达的路径,明显往中国本土 AI 芯片生态那边靠。
这件事为什么重要。
因为现在所有人都知道,大模型竞争已经不是单纯模型竞争了。算力、芯片、部署、供应链,全都在牌桌上。
你模型做得再强,如果只能锁死在某一套被卡脖子的硬件生态里,那你的上限就不只是技术问题。
当然,遗憾也很明显。
最大的一块,就是多模态没来。
现在多模态几乎已经成了标配。
你没有视觉能力,看不了图,很多Agent场景就天然缺一块。
截图分析、界面理解、Computer Use、审美延伸,这些能力都会受影响。
V4这次还是纯文本,这一点肯定会让不少人失望。
但换个角度说,这也说明了它这次的优先级很明确。
它先要把更底层的东西打稳,
长上下文、Agent、开源、硬件适配、生产接口、价格体系,这些先落下来,
多模态那张牌没现在就摊开,不代表没有做,更像是还没到它现在最想打的时间点。
V4虽然称不上特别惊艳,
但国内大模型终于在一条更现实、更完整的路径上,往前扎实地迈出了一步。
DeepSeek这次还引用了荀子一句话,
不诱于誉,不恐于诽,率道而行,端然正己。
对我们来说,也很有启发。
因为真正有价值的技术,从来不只是看起来更强,
还要能接进真实业务,接进系统,接进数据,最后变成稳定可用的能力。
这也是极客上线一直在做的事。
我们关注每一次模型变化,但比起追逐一时的热度,
我们更在意的是,哪些能力能真正落进企业场景,哪些积累能在下一轮变化里继续发力。
愿我们都能在这个快速发展的时代里,把眼前的事做扎实,把脚下的路走的更稳。
厚积薄发,慢一点没关系,重要的是一直向前。


