DeepSeek Code 2.0传闻:3万亿参数,对标GPT-6 Astra

AI资讯10分钟前发布 Lubos
1.3K 0

先说清楚这是传闻,没有官方确认。

业界流出的说法是,DeepSeek 在准备一款叫 DeepSeek Code 2.0 的全新大模型,参数规模 3 万亿,目标对标 GPT-6 Astra。

要评估这条传闻的可信度,得看它上一步走到哪了。本周 DeepSeek 正式推出了 V4.1 Flash,官方没给新的大版本号,但底层架构的改动幅度按实际能力算已经够得上换代。官方同时确认后续会推 V4.1 Pro 系列。

一家在半年内把架构重做一遍、并且已经预告了 Pro 线的公司,同时在憋一款专攻代码的超大模型,这个组合并不离谱。

3 万亿这个数字反倒是最可疑的部分。DeepSeek 一贯的技术路线是在给定算力下把效率榨到极限,V3 系列靠 MoE 架构和训练成本控制出圈,不是靠堆参数。突然换成硬堆规模的打法,要么是路线真变了,要么是这个数字在传播链条里被人加了个零。

代码模型这块现在竞争密度很高。Claude 的编码线、Codex、Kimi 的 K2.7 Code,各家都在同一个窄赛道里卷。DeepSeek 如果真出 Code 2.0,价格大概率还是那把最锋利的刀。

© 版权声明

相关文章

DeepSeek Code 2.0传闻:3万亿参数,对标GPT-6 Astra 暂无评论

none
暂无评论...