科技·商业·财经

DeepSeek新动向:DeepSeek Code 2.0或9月登场,3万亿参数挑战前沿大模型

   时间:2026-09-14 17:14 作者:柳晴雪

近日,科技圈传出关于DeepSeek的多个重磅消息,引发行业广泛关注。其中,DeepSeek V4.1 Flash的发布成为焦点,这款大模型在架构上进行了大刀阔斧的革新,其变化程度之大,即便称其为V5也毫不为过,但DeepSeek却选择保持低调,未更换大版本号。与此同时,Pro系列的新品也已确定为V4.1 Pro,不过具体升级内容尚未对外公布。鉴于此前V4到V4.1的提升幅度,外界推测V4.1 Pro的性能上限值得期待,但考虑到此前V4 Pro - 0813正式版表现未达预期,外界对其期待值也保持了一定的理性。

另一则备受瞩目的消息是,DeepSeek Code 2.0有望在9月份闪亮登场。据爆料,这款大模型将主打电脑控制功能,旨在让AI能够替代用户操作电脑完成大量工作。在性能方面,它被寄予厚望,预计将击败当前最强大的两个前沿级大模型——Mythos 5.1和GPT - 6 Astra。值得一提的是,Astra许多令人惊叹的表现正是源于其强大的电脑控制能力。

在参数量方面,DeepSeek Code 2.0更是展现出惊人的实力。爆料称其参数量高达3万亿以上,这一规模使其成为国内大模型中的佼佼者。作为对比,国内目前参数量最大的是K3大模型,为2.8万亿;千问Qwen 3.8 Max为2.4万亿;而DeepSeek V4 Pro仅为1.6万亿。从V4.1 Flash换用新结构使参数量翻倍的情况来看,Code 2.0从当前的1.6万亿提升到3万亿参数具有一定的可信度。毕竟,要与Mythos 5.1和Astra这样的大模型竞争,达到这个级别的参数量是提升性能上限的关键,否则很难在性能上取得突破。

不过,这一爆料的真实性仍有待进一步验证。回顾2023至2024年,DeepSeek曾推出过三款名字中带有Code的大模型,但当时的表现并不突出。此次若重新推出偏向代码和逻辑的Code大模型,并将其作为旗舰级产品,也不失为一种战略选择。这样一来,V4.1 Pro及Flash可以专注于通用Agent任务,形成不同产品之间的差异化定位。

 
 
更多>同类内容
全站最新
热门内容