2026年4月24日,DeepSeek V4正式發(fā)布。這條新聞的技術(shù)細節(jié)值得細品:全球首個在純國產(chǎn)算力上完成訓(xùn)練的萬億參數(shù)級MoE大模型——昇騰910B/C負責訓(xùn)練,昇騰950PR負責推理,從英偉達CUDA生態(tài)到華為CANN框架,重寫超過200個核心算子,最終以520萬美元的訓(xùn)練成本,性能達到A100集群的85%,推理速度較初始版本提升35倍。

此前,國產(chǎn)芯片的訂單很大程度來自政府采購和合規(guī)要求——你得用,不是你想用。政務(wù)云信創(chuàng)適配完成率92.3%,但這些數(shù)字多少帶著"規(guī)定動作"的意味。DeepSeek V4的出現(xiàn)改變了這道選擇題的性質(zhì)。阿里、字節(jié)、騰訊隨后宣布新增大模型訓(xùn)練優(yōu)先采用國產(chǎn)算力——風向變了。用DeepSeek團隊的話說:"以前用英偉達是'不得不',現(xiàn)在用國產(chǎn)是'主動選'。"這不是一句場面話。全國日均Token調(diào)用量從2024年初的1000億,飆升至2026年3月的140萬億,增長超過1000倍。算力需求在指數(shù)級膨脹,而H20出口受限、H100一卡難求的局面并未改變。國產(chǎn)算力不是"備胎",是剛需。更深層的意義在于:DeepSeek V4證明國產(chǎn)算力已經(jīng)跨越了"能不能用"的門檻,正走向"好不好用"的下一站。這條路,GPU走通了。
但算力不只是GPU
當我們談?wù)撍懔r,GPU往往是第一個跳入腦海的詞。但在AI訓(xùn)練和推理的完整鏈路中,算力從來不是孤立存在的。一個萬卡集群中,GPU與GPU之間每秒需要交換TB級數(shù)據(jù)。光模塊速率正從400G向800G、1.6T躍升。英偉達GB200/NVL72等平臺對網(wǎng)絡(luò)帶寬的要求,直接推動了1.6T光模塊的大規(guī)模商用——僅英偉達一家,2026年對1.6T光模塊的采購量就超過30萬只。

沒有高速網(wǎng)絡(luò),再強的GPU也得干等。算力決定"速度",網(wǎng)絡(luò)決定"效率"。網(wǎng)絡(luò)延遲每增加1毫秒,萬卡集群的整體訓(xùn)練效率可能下降數(shù)個百分點。這意味著,國產(chǎn)算力的崛起不僅是芯片的事。以網(wǎng)絡(luò)適配器(網(wǎng)卡)和光模塊為代表的網(wǎng)絡(luò)設(shè)備,同樣是算力基礎(chǔ)設(shè)施的關(guān)鍵一環(huán)。它們構(gòu)成了數(shù)據(jù)在GPU之間、服務(wù)器之間流動的"高速公路"。而這條高速公路,目前同樣正處于從"能用"到"好用"的產(chǎn)業(yè)自證階段。
算力端的突破正在傳導(dǎo)至網(wǎng)絡(luò)設(shè)備端。AI訓(xùn)練集群對網(wǎng)絡(luò)帶寬和延遲的極高要求,使得高速網(wǎng)卡、智能網(wǎng)卡、RDMA網(wǎng)絡(luò)等網(wǎng)絡(luò)底層設(shè)備的重要性急劇上升。一個趨勢正在形成:隨著國產(chǎn)算力芯片逐步進入企業(yè)核心生產(chǎn)系統(tǒng),下游客戶開始更主動地尋求網(wǎng)絡(luò)層面的全國產(chǎn)替代方案。不是因為政策要求,而是在尋找與國產(chǎn)算力芯片更適配、響應(yīng)更快、成本更優(yōu)的網(wǎng)絡(luò)設(shè)備供應(yīng)商。
這正是國產(chǎn)網(wǎng)絡(luò)設(shè)備廠商的機會窗口。光潤通科技正是這個窗口中的參與者。作為國內(nèi)網(wǎng)絡(luò)通信設(shè)備的專業(yè)制造商,光潤通自研G710G2以太網(wǎng)控制器,推出FF系列國產(chǎn)網(wǎng)卡,覆蓋萬兆、25G、100G等多速率產(chǎn)品線,可適配飛騰、鯤鵬、龍芯、海光、申威等國產(chǎn)CPU平臺,兼容麒麟、UOS等國產(chǎn)操作系統(tǒng)。

在信創(chuàng)生態(tài)適配方面,在信創(chuàng)生態(tài)適配方面,光潤通積極推薦移動云、阿里云、騰訊云、華為云的兼容性認證。光潤通網(wǎng)卡已完成六大國產(chǎn)平臺適配,涵蓋飛騰、鯤鵬、龍芯、海光、申威、ARM+麒麟等主流架構(gòu)。從芯片到驅(qū)動,光潤通實現(xiàn)了核心環(huán)節(jié)的自主閉環(huán),確保網(wǎng)卡與國產(chǎn)系統(tǒng)、國產(chǎn)芯片的深度協(xié)同。這意味著,當客戶需要針對特定國產(chǎn)平臺做驅(qū)動定制優(yōu)化時,光潤通的響應(yīng)周期遠低于依賴外部IP授權(quán)的廠商。產(chǎn)品維度上,光潤通的FF系列網(wǎng)卡覆蓋了多個關(guān)鍵場景:Bypass網(wǎng)卡保障關(guān)鍵業(yè)務(wù)鏈路的零中斷,單向網(wǎng)卡實現(xiàn)物理層數(shù)據(jù)流向管控,智能加密網(wǎng)卡提供硬件級數(shù)據(jù)安全,100G/200G高速網(wǎng)卡支撐AI訓(xùn)練和云計算的高帶寬需求。這些產(chǎn)品在金融、能源、政府、軍工等關(guān)鍵領(lǐng)域已有落地部署。
DeepSeek V4用國產(chǎn)算力訓(xùn)練成功,證明國產(chǎn)芯片已經(jīng)從"跟跑"進入"并跑"階段。但這只是一個開始。一個完整的AI算力集群,從芯片到應(yīng)用,中間還有網(wǎng)絡(luò)、存儲、散熱、電力等多個環(huán)節(jié)。任何一環(huán)成為短板,都會導(dǎo)致整體效率大打折扣。當國產(chǎn)算力芯片的性能逐步逼近國際頭部產(chǎn)品,下一階段的競爭焦點很可能會從單卡算力轉(zhuǎn)向系統(tǒng)級能力——而網(wǎng)絡(luò),正是系統(tǒng)級能力的關(guān)鍵組成部分。就像DeepSeek團隊花14個月做的那場"換心手術(shù)"——從CUDA遷移到CANN,重寫200多個核心算子——國產(chǎn)網(wǎng)絡(luò)設(shè)備的成熟,同樣需要這樣的時間投入和技術(shù)耐心。
但方向已經(jīng)明確。算力的自主可控,不會止步于芯片。當國產(chǎn)算力從"政策驅(qū)動"走向"產(chǎn)業(yè)自證",網(wǎng)絡(luò)設(shè)備的國產(chǎn)化替代也將循著同樣的路徑:從"能用"到"好用",從"合規(guī)采購"到"主動選擇"。國產(chǎn)算力的"最后一公里",是網(wǎng)絡(luò)。光潤通科技將繼續(xù)深耕國產(chǎn)網(wǎng)卡與光通信領(lǐng)域,以"光聯(lián)天下,潤通你我"為愿景,攜手上下游伙伴,共同構(gòu)建安全可控的算力基礎(chǔ)設(shè)施。