快科技9月13日消息,本周 DeepSeek 发布了 V4.1 Flash,这个大模型架构变化之大,完全可以称得上是 V5 了,但 DeepSeek 很低调地没换大版本号。

V4.1 Pro 确定,具体升级尚未公布

Pro 系列的新品确定了是 V4.1 Pro,具体升级还没公布。如果是 V4 到 V4.1 这样的提升幅度,那 V4.1 Pro 性能上限也会很高,但考虑到之前 V4 Pro-0813 正式版的不及预期,大家期待值不要拉太高。

DeepSeek Code 2.0 即将发布

后续还有一波大模型,爆料者称它叫做 DeepSeek Code 2.0,即将发布,时间窗口是 9 月份,预计性能会击败 Mythos 5.1GPT-6 Astra,这是当前最强大的两个前沿级大模型。

其他方面,DeepSeek Code 2.0 预计会继续保持开源开放,设计重点是 Computer Use,也就是电脑控制,AI 替代你操作电脑完成很多工作,Astra 目前很多让人惊讶的使用就来自这一方面。

DeepSeek 下一波大模型被指即将问世:3万亿参数,性能超 GPT-6 Astra。

3万亿以上参数量

这个 Code 2.0 拥有高达 3万亿以上的参数量,显然这也是它提高性能的关键。这方面国内目前最强的是 K3 大模型的 2.8万亿,千问的 Qwen 3.8 Max 是 2.4万亿参数量,DeepSeek V4 Pro 是 1.6万亿参数。

模型 参数量
DeepSeek Code 2.0(爆料) 3万亿以上
K3 大模型 2.8万亿
Qwen 3.8 Max 2.4万亿
DeepSeek V4 Pro 1.6万亿

从 V4.1 Flash 看参数翻倍的可信度

从 V4.1 Flash 换用新结构使得参数量翻倍来看,这个 Code 2.0 从当前 1.6万亿提升到 3万亿参数的可信度是有的。想跟 Mythos 5.1 及 Astra 这样的大模型竞争就需要这个级别的参数量,不然性能上限是很难提升的。

爆料可信度与产品定位

这个爆料的可信度不好说,DeepSeek 过去的 23-24 年倒是推出过三款名字带 Code 的大模型,不过那时候表现平平。这次要是重推偏向代码/逻辑的 Code 大模型,作为旗舰级产品倒也不失为一个方向,就让 V4.1 Pro 及 Flash 面向通用 Agent 任务即可。

体验 DeepSeek 网页版

免费对话、文档解析、代码生成,打开浏览器即可使用