METROHK.com.hk
市場
科技

DeepSeek擬增用華為晶片訓練AI模型

內地人工智能實驗室DeepSeek創辦人梁文鋒表示,計劃在AI模型訓練中採用更多國產晶片,包括華為產品,並預期華為最早於2026年第四季或明年首季交付。梁文鋒認為華為AI晶片效能數年內可追上Nvidia,因此決定擴大非Nvidia生態系統的硬件應用。

DeepSeek擬增用華為晶片訓練AI模型

內地人工智能實驗室DeepSeek創辦人梁文鋒表示,公司計劃在AI模型訓練中採用更多國產晶片,包括華為產品,預期華為最早於2026年第四季或明年首季交付相關晶片。梁文鋒形容,使用華為及其他國產晶片進行AI訓練是公司其中一項重大策略部署,並強調這項行動必須成功。

梁文鋒評估,華為的AI晶片效能將在數年內追上Nvidia,因此公司決定採用Nvidia核心生態系統以外的硬件。與此同時,DeepSeek正訓練一個擁有2萬億參數的模型,並計劃日後開發8萬億參數的模型。市場估計,這個2萬億參數模型將是即將推出的DeepSeek V4.1 Pro,可能於10月中或月底亮相。

據內地傳媒計算,訓練2萬億參數模型需要50萬億至60萬億個token,相等於3萬張Nvidia H100/H200晶片或1.5萬張B200晶片的運算能力。若改用華為Ascend 910C或Ascend 950系列晶片,所需數量將分別約為6萬張及3萬張。

資料來源:The Standard閱讀原文報道 →
陳嘉明
總編輯

統籌港聞及政府政策報道,主理本網每日的頭條取捨與發稿標準。