據報DeepSeek創辦人梁文鋒在會議中透露,公司將採用華為晶片來訓練AI模型。(資料圖片/路透社)
據The Information報道,內地人工智能(AI)公司DeepSeek創辦人梁文鋒在會議中透露,公司將採用華為晶片來訓練AI模型,預料華為最快在今年第四季或明年首季可交付晶片訓練AI。
報道指,梁文鋒向投資者表示,採用華為或其他國產處理器進行訓練是DeepSeek「最大的押注之一」(one of our biggest bets),而這項工作必須成功。他預期華為晶片將於數年內將追上輝達(Nvidia)的水平。
梁文鋒又稱,DeepSeek目前正訓練一個2萬億參數模型,並已超過其旗艦模型的1.4萬億參數,另將計劃訓練一個8萬億參數的模型。
另外,據內媒快科技報道,2萬億參數模型預期是將發布的「DeepSeek V4.1 Pro」,傳大機會在10月中旬至下旬發布。報道提及,訓練2萬億參數量的AI大模型需要50萬至60萬億Token,按照目前顯卡算力估算,需要3萬張輝達(Nvidia)H100或H200晶片,B200則需要1.5萬張,華為昇騰910C需要6萬張,如果是華為昇騰950系列需3萬張,跟H200差不多。

















