DeepSeek把8万亿写进路线图,参数军备赛没人喊停

原创
alex 3小时前 阅读数 3 #头条
参数规模竞赛又添了一把火。一条推文曝出,DeepSeek正在训练一个2万亿参数的模型,8万亿已写进路线图。这要是真的,意味着什么?GPT-4据传只有1.8万亿,DeepSeek直接甩在身后。一家来自中国的、资源远不如硅谷巨头的公司,选择用暴力美学把scaling law推到新极端——这说明他们赌的就是:更多参数等于更强智能,哪怕硬件成本指数级飙升。8万亿听着像科幻,但如果你问DeepSeek,他们大概会反问:为什么不可能?

原文:DeepSeek is training a 2T-parameter model and plans to build an 8T-parameter one · 来源:Hacker News

版权声明

所有资源都来源于爬虫采集,如有侵权请联系我们,我们将立即删除