DeepSeek被称为AI界拼多多，训练2个月仅花费了557.6万美元！

来源：看球网 2025-01-28 16:47:15

1月28日讯据钱江晚报报道，此次DeepSeek-V3在AI行业引发关注，关键的原因在于——超低的预训练成本。

“预训练”是AI大模型学习中的一种方法，指的是通过海量的数据，训练一个大模型。训练时需要大量的数据和算力支持，每次迭代可能耗资数百万至数亿美元。

官方技术论文披露，DeepSeek-V3在预训练阶段仅使用2048块GPU训练了2个月，且只花费557.6万美元。这个费用是什么概念？

据报道，GPT-4o的模型训练成本约为1亿美元。简单粗暴地说，这相当于DeepSeek-V3比同等性能的AI大模型，降了十几倍的成本。

早在2024年5月，深度求索发布DeepSeek-V2时，就曾因给模型的定价太过于便宜，开启了中国大模型的价格战，被称之为“AI界的拼多多”。

undefined

“相比于说它是‘拼多多’，它更像小米，贴近成本定价，并且自产自销。”马千里认为，训练成本比较低的原因，离不开深度求索团队自研的架构和算力，他们自身的算力储备可以与大厂比肩，并且更注重底层的模型。

“ChatGPT走的是大参数、大算力、大投入的路子，DeepSeek-V3的路径用了更多的巧思，依托数据与算法层面的优化创新，从而高效利用算力，实现较好的模型效果。”马千里说道。

相关阅读

外媒盛赞：《光与影33号远征队》将会是2025年度最佳游戏！

LPL解说杯赛程赛制：淘汰赛"有畏征兆"模式，打到第五局自信盲选

解说Joker：LPL明年拍卖规则很复杂，薪资透明化竞争公平化是好事

LVG下半场进攻乏力bodyy强力输出3DMAX全员发挥扳平比分

这是真出名了《星鸣特攻》失败案例被英国议会引用

持续侮辱、诽谤米哈游，博主因名誉侵权被判赔偿11万元并道歉声明

尴尬了AL五人开局蹲野区想抓Oner，结果Oner在河道挂机看蒙多技能

Joker：LPL始终起码有一支争冠实力队伍未来5年应该能拿一次S冠

Evi晒出和impact合照：感谢你陪伴我度过的美好时光

Switch已卖出1亿5401万台销量即将超NDS成史上第二畅销游戏主机

热门标签

热门录像

查看全部>

11月04日NBA常规赛热火快船全场录像

11月04日NBA常规赛湖人开拓者全场录像

11月04日NBA常规赛森林狼篮网全场录像

11月03日NBA常规赛公牛尼克斯全场录像

11月03日NBA常规赛76人篮网全场录像

11月02日NBA常规赛火箭凯尔特人全场录像

11月01日NBA西部NBA杯C组掘金开拓者全场录像

11月01日NBA西部NBA杯A组爵士太阳全场录像

11月01日NBA东部NBA杯B组凯尔特人76人全场录像

10月31日NBA常规赛勇士雄鹿全场录像

DeepSeek被称为AI界拼多多，训练2个月仅花费了557.6万美元！

相关阅读

热门标签

热门新闻