国产日本欧美在线|国产无套粉嫩白浆在线|香蕉久久夜色精品国产|久久精品国产亚洲AV夜夜|国产av综合一区二区三区|国产精品久久久久jk制服|欧洲精品一区二区三区在线观看|国产内射爽爽大片视频社区在线

DeepSeek被稱為AI界拼多多,訓練2個月僅花費了557.6萬美元!

來源:24直播網
體育資訊1月28日報道宣稱 據錢江晚報報道,此次DeepSeek-V3在AI行業(yè)引發(fā)關注,關鍵的原因在于——超低的預訓練成本。

“預訓練”是AI大模型學習中的一種方法,指的是通過海量的數據,訓練一個大模型。訓練時需要大量的數據和算力支持,每次迭代可能耗資數百萬至數億美元。

官方技術論文披露,DeepSeek-V3在預訓練階段僅使用2048塊GPU訓練了2個月,且只花費557.6萬美元。這個費用是什么概念?

據報道,GPT-4o的模型訓練成本約為1億美元。簡單粗暴地說,這相當于DeepSeek-V3比同等性能的AI大模型,降了十幾倍的成本。

早在2024年5月,深度求索發(fā)布DeepSeek-V2時,就曾因給模型的定價太過于便宜,開啟了中國大模型的價格戰(zhàn),被稱之為“AI界的拼多多”。

undefined

“相比于說它是‘拼多多’,它更像小米,貼近成本定價,并且自產自銷?!瘪R千里認為,訓練成本比較低的原因,離不開深度求索團隊自研的架構和算力,他們自身的算力儲備可以與大廠比肩,并且更注重底層的模型。

“ChatGPT走的是大參數、大算力、大投入的路子,DeepSeek-V3的路徑用了更多的巧思,依托數據與算法層面的優(yōu)化創(chuàng)新,從而高效利用算力,實現較好的模型效果?!瘪R千里說道。

武胜县| 余姚市| 刚察县| 桦甸市| 鹰潭市| 永丰县| 永胜县| 从化市| 绥滨县| 邹城市| 芦溪县| 靖宇县| 手机| 广德县| 阳山县| 中卫市| 桃源县| 六枝特区| 成武县| 平湖市| 金川县| 额济纳旗| 集贤县| 襄樊市| 蒙自县| 崇左市| 丰城市| 滦南县| 丁青县| 江口县| 和林格尔县| 汕尾市| 获嘉县| 武汉市| 德保县| 盘锦市| 辰溪县| 通江县| 喜德县| 剑河县| 北票市|