DeepSeek被稱為AI界拼多多,訓練2個月僅花費了557.6萬美元!
- 發布于:2025-01-28 14:19:27
- 來源:藍鯨體育
1月28日訊 據錢江晚報報道,此次DeepSeek-V3在AI行業引發關注,關鍵的原因在于——超低的預訓練成本。
“預訓練”是AI大模型學習中的一種方法,指的是通過海量的數據,訓練一個大模型。訓練時需要大量的數據和算力支持,每次迭代可能耗資數百萬至數億美元。

官方技術論文披露,DeepSeek-V3在預訓練階段僅使用2048塊GPU訓練了2個月,且只花費557.6萬美元。這個費用是什么概念?
據報道,GPT-4o的模型訓練成本約為1億美元。簡單粗暴地說,這相當于DeepSeek-V3比同等性能的AI大模型,降了十幾倍的成本。
早在2024年5月,深度求索發布DeepSeek-V2時,就曾因給模型的定價太過于便宜,開啟了中國大模型的價格戰,被稱之為“AI界的拼多多”。

“相比于說它是‘拼多多’,它更像小米,貼近成本定價,并且自產自銷。”馬千里認為,訓練成本比較低的原因,離不開深度求索團隊自研的架構和算力,他們自身的算力儲備可以與大廠比肩,并且更注重底層的模型。
“ChatGPT走的是大參數、大算力、大投入的路子,DeepSeek-V3的路徑用了更多的巧思,依托數據與算法層面的優化創新,從而高效利用算力,實現較好的模型效果。”馬千里說道。
以上內容請關注首頁JRS
相關資訊
- 體育戰報 | 十五運看灣區:世界級城市群浮現三大信號
- 體育戰報 | 吳艷妮:想沖擊全國紀錄,無奈天冷有影響,決賽必將拼盡全力
- 體育戰報 | 男子110米欄后浪翻涌,35歲謝文駿帶傷謝幕無緣沖四連冠
- 體育戰報 | 世紀大決戰,明晚18點!
- 體育戰報 | 全運會溫暖合影,美好回憶:黃東萍和她的戰友們
- 體育戰報 | 全運會羽毛球迎來單項終極對決,老將新秀決賽爭輝
- 體育戰報 | 這,就是賽場上的少年感天花板!
- 體育戰報 | WTA年度大獎提名揭曉:榮譽歸屬幾無懸念,網壇新秩序悄然成型
- 體育戰報 | 德約科維奇與希臘總理會面欲在希臘收購大型體育設施
- 體育戰報 | 薩巴倫卡提名最佳球員被打趣最該獲獎,網友給出無可辯駁幽默理由
最新資訊
- 體育戰報 | 十五運看灣區:世界級城市群浮現三大信號
- 體育戰報 | 吳艷妮:想沖擊全國紀錄,無奈天冷有影響,決賽必將拼盡全力
- 體育戰報 | 男子110米欄后浪翻涌,35歲謝文駿帶傷謝幕無緣沖四連冠
- 體育戰報 | 世紀大決戰,明晚18點!
- 體育戰報 | 全運會溫暖合影,美好回憶:黃東萍和她的戰友們
- 體育戰報 | 全運會羽毛球迎來單項終極對決,老將新秀決賽爭輝
- 體育戰報 | 這,就是賽場上的少年感天花板!
- 體育戰報 | WTA年度大獎提名揭曉:榮譽歸屬幾無懸念,網壇新秩序悄然成型
- 體育戰報 | 德約科維奇與希臘總理會面欲在希臘收購大型體育設施
- 體育戰報 | 薩巴倫卡提名最佳球員被打趣最該獲獎,網友給出無可辯駁幽默理由
