时隔不到两个月,DeepSeek V4.1 已经开始灰度测试了。今天有网友发现 DeepSeek 网页版的模型疑似换上了新版本,代码能力的提升被形容为"天差地别的变化"。
据 Linux.do 社区网友爆料,灰度测试中的 V4.1 Flash 有两个明显变化:
• 知识截止日期从2025 年 5 月更新到2026 年 1 月(部分用户测试甚至到了 2026 年 5 月)
图片
• 代码能力显著提升,特别是在 Three.js 等复杂场景的 SVG 生成测试中表现优秀
这意味着 V4.1 在后训练阶段(post-training)做了大量工作,代码理解与生成能力是本次升级的核心方向。
▎什么时候发?
DeepSeek 有节假日前后发布新模型的习惯。按照 V4.0 发布时的节奏——Flash 版先灰度、再正式上线,Pro 版紧随其后——这次大概率是同样的路径。
最快本周或端午前后就能看到正式发布。社区已经开始陆续收到灰度测试邀请,每个人的测试结果不尽相同,说明 DeepSeek 正在分批验证不同版本的效果。
▎V4.1 跟 V4 比,有什么不同?
回看 V4.0(4 月 24 日发布)的核心参数:
• V4 Pro:1.6T 总参数 / 49B 激活参数,支持 100 万 token 上下文
• V4 Flash:284B 总参数 / 13B 激活参数,主打效率
• SWE-bench 编程基准:V4 Pro 80.6%,与 Claude Opus 4.7(80.9%)仅差 0.3 个百分点
• API 定价:输入 1 元/百万 token,仅为 GPT-5.5 的 1/30
V4.1 的架构大概率不会大改,核心升级在于后训练优化和代码能力的专项提升。V4 的基模能力本来就不弱,缺的是后训练阶段的精调——这两个月的打磨,让代码能力有了质的飞跃。
▎多模态这次可能不上
值得注意的是,V4.1 大概率不会包含多模态能力。原因有二:一是多模态对算力的要求远高于纯文本,而 DeepSeek 的定价极低(V4 Pro 输入仅 1 元/百万 token),算力本就紧张;二是第三方反代问题已经很严重,加上多模态后会进一步加剧。所以 DeepSeek 并不急着补这个短板。
▎这意味着什么?
DeepSeek V4.1 的快速迭代释放了一个信号:开源模型的更新节奏正在加速。从 V3 到 V4 用了 16 个月,从 V4 到 V4.1 只用了不到 2 个月。这对于使用 DeepSeek 做 Agent 开发、代码辅助的团队是个好消息——模型的代码理解和生成能力持续提升,但成本没有变。


