DeepSeek重磅押注國產算力 改用華為晶片訓練超大型AI模型 力追輝達技術

內地知名人工智能獨角獸DeepSeek創辦人梁文鋒對投資者透露,公司將全面改用華為國產AI晶片訓練頂級大模型,視之為公司未來最重要的技術戰略押注之一,同時預期華為晶片數年內技術水平可追上美國巨頭輝達(Nvidia)。華為最快今年第四季或明年首季交付相關算力晶片,供DeepSeek展開大規模模型訓練。

梁文鋒直言,轉用華為及其他國產處理器建構訓練體系,是DeepSeek「最大的技術賭注」,亦是公司必須成功達成的轉型目標。面對海外高端晶片供應不穩、國際算力壁壘升高,DeepSeek棄依賴進口晶片、全力擁抱國產算力生態,成為內地頂級AI企業自主化布局的重要指標。他樂觀預計,華為昇騰系列晶片經過迭代升級,數年內整體效能、穩定性可追平輝達頂級GPU水平。

與此同時,DeepSeek正全速推進超大型參數AI模型研發,突破自身技術上限。目前團隊正訓練2萬億參數全新大模型,超越現有旗艦模型1.4萬億參數的規模;未來更進一步規劃研發8萬億參數頂級AI模型,衝擊全球頂尖算力水平。

據內媒《快科技》披露,這款2萬億參數新模型將定名為DeepSeek V4.1 Pro,預計今年10月中旬至下旬正式發布,成為DeepSeek新一代旗艦產品。技術資料顯示,訓練2萬億參數巨型模型,需消耗高達50萬至60萬億Token算力資源,對晶片數量與集群規模要求極高。

業界拆解不同晶片的算力配比門檻:若採用輝達H100或H200高端晶片,需要3萬張才可完成訓練;新一代B200可節省一半,需約1.5萬張;若改用國產華為晶片,昇騰910C需6萬張,而性能更強的昇騰950系列僅需3萬張,算力規模已與輝達H200看齊,證明華為高端AI晶片已具備支撐萬億級大模型的實力。

市場分析認為,今次DeepSeek全面押注華為算力,標誌內地頂級AI研發正式脫離對海外晶片的單一依賴,國產昇騰晶片開始承接全球頂尖超大型模型訓練任務。隨國產算力硬件持續迭代、生態不斷成熟,配合內地企業大模型研發提速,將加速推動中國AI產業實現硬件、軟體、模型全鏈路自主可控。