站长之家 - 业界 2026-09-14 09:27

DeepSeek下一波大模型被指即将问世:3万亿参数 性能超GPT-6 Astra

快科技9月13日消息,本周DeepSeek推出了V4.1 Flash。该模型在架构层面调整幅度较大,甚至足以被视为V5级别,不过官方并未因此提升主版本号,显得较为克制。

Pro系列新产品已确定为V4.1 Pro,具体升级内容尚未披露。如果参考V4到V4.1的改进幅度,V4.1 Pro的性能上限同样值得关注;但鉴于此前V4 Pro-0813正式版表现未达预期,外界预期不宜过高。

后续还有一款大模型即将面世。据爆料者透露,该产品名为DeepSeek Code 2.0,发布时间预计落在9月,性能有望超越Mythos 5.1和GPT-6 Astra,两者是目前处于前沿水平的顶尖大模型。

此外,DeepSeek Code 2.0预计仍将坚持开源开放策略,设计重点放在Computer Use,即电脑控制上,可代替用户操作电脑完成多项任务。Astra当前不少令人印象深刻的用途正来源于这一能力。

DeepSeek下一波大模型被指即将问世:3万亿参数 性能超GPT-6 Astra

Code 2.0的参数规模预计超过3万亿,这也是其性能提升的重要基础。目前国内同类模型中,K3大模型以2.8万亿参数量居前,千问Qwen 3.8 Max参数量为2.4万亿,DeepSeek V4 Pro则为1.6万亿。

考虑到V4.1 Flash因采用新结构而实现参数量翻倍,Code 2.0从现有1.6万亿提升至3万亿级别的说法具备一定可信度。若要与Mythos 5.1和Astra等模型展开竞争,这一参数量级几乎必不可少,否则性能上限难以进一步突破。

这则爆料的可靠性尚难判断。DeepSeek在2023至2024年曾推出过三款带有“Code”名称的大模型,但当时表现较为普通。如果此次重新推出侧重代码与逻辑能力的Code大模型,并将其作为旗舰产品,也未尝不是一种合理选择,V4.1 Pro和Flash则可继续面向通用智能体任务。

DeepSeek下一波大模型被指即将问世:3万亿参数 性能超GPT-6 Astra

推荐关键词

24小时热搜

查看更多内容

大家正在看