万字揭秘DeepSeek !这个创新让全世界疯狂复制,顶尖AI人才年薪千万,训练成本被低估  | 半导体研究机构 Semianalysis

DeepSeek引发全球热议的背后,真正推动舆论转向的是其在算法和工程上的效率提升,而不是外界流传的“低成本神话”。Semianalysis的分析从算力、团队、训练成本和模型性能几条线索展开:推测其拥有约5万块Hopper GPU、服务器资本支出超过16亿美元,团队约150人,并从中国顶尖高校吸纳人才,部分岗位年薪接近千万。报告还强调,广为传播的600万美元只算预训练GPU开销,不等于总成本;MLA把KV缓存大幅压缩,才是降低推理成本的关键创新。与o1等模型的对比则显示,R1以更低价格提供接近的能力,说明AI竞争正在从单纯比算力,转向比效率、定价权和持续迭代能力。

正文

THE END
分享
评论 抢沙发

请登录后发表评论

    暂无评论内容