HongKongNews.com.hk 香港新聞
市場
科技

DeepSeek擬增用華為晶片訓練AI模型

人工智能實驗室DeepSeek創辦人梁文峰表示,計劃採用更多國產晶片(包括華為)訓練AI模型,並將此視為重大戰略決定。華為最快於2026年第四季或明年首季交付晶片。梁文峰又透露正訓練2萬億參數模型,並計劃未來開發8萬億參數模型。

DeepSeek擬增用華為晶片訓練AI模型

中國人工智能實驗室DeepSeek創辦人梁文峰表示,公司計劃採用更多國產晶片(包括華為)訓練AI模型,並將此舉視為重大戰略決定,必須成功。據《The Information》報道,華為最快於2026年第四季或明年首季交付晶片。

梁文峰指出,採用華為及其他國產晶片訓練AI是公司其中一項最大戰略賭注,並評估華為AI晶片性能將於數年內追上輝達(Nvidia),因此決定採用輝達生態系統以外的硬件。

與此同時,梁文峰向投資者透露,DeepSeek正訓練一個擁有2萬億參數的模型,並計劃未來開發一個8萬億參數的模型。市場估計,該2萬億參數模型將是即將推出的DeepSeek V4.1 Pro,最快於10月中或月底亮相。

據內地媒體計算,訓練2萬億參數模型需要50萬億至60萬億個token,相當於3萬張輝達H100/H200晶片的算力,或1.5萬張B200晶片。若改用華為Ascend 910C或Ascend 950系列,所需晶片數量將分別約為6萬張及3萬張。

資料來源:The Standard閱讀原文報道 →
編輯部

統籌港聞、政府公告及全站編務。