
在 7 月 17 日至 20 日舉行的 2026 世界人工智能大會(WAIC)上,超節(jié)點成為全場焦點。據(jù)記者不完全梳理,超過 20 家企業(yè)發(fā)布了與超節(jié)點相關(guān)的產(chǎn)品或方案。
早在 2025 年 9 月的華為全聯(lián)接大會上,昇騰 Atlas950 超節(jié)點首次發(fā)布,但當時外界只看到了產(chǎn)品參數(shù)和渲染圖,真機并未露面。此后近一年,950 超節(jié)點的實際性能表現(xiàn)、量產(chǎn)進度是否如期推進等,一直是關(guān)注國產(chǎn)算力的投資人和產(chǎn)業(yè)人士追問的焦點。
" 貴百分之一百無所謂,貴百分之兩百都無所謂。"
今年 7 月,一份 DeepSeek 創(chuàng)始人梁文鋒在兩個月前舉辦的投資者交流會上發(fā)言的錄音文字稿開始在投資圈流傳。在這份近四小時的交流記錄中,梁文鋒談到華為超節(jié)點與英偉達產(chǎn)品的價格差距時作出了上述表態(tài)。
梁文鋒還就 DeepSeek 的開源策略、AGI(通用人工智能)技術(shù)路線圖、API(應用程序接口,外部用戶調(diào)用 AI 模型能力的技術(shù)通道)定價邏輯以及中美算力差距和國產(chǎn)芯片替代前景等話題發(fā)表了看法,其中關(guān)于國產(chǎn)算力的評價在網(wǎng)絡(luò)上引發(fā)了廣泛討論。
一位接近 DeepSeek 投資方的知情人士向經(jīng)濟觀察報記者確認了該文字稿的真實性。7 月 24 日,記者亦通過電話和郵件的方式就這份錄音文字稿的真實性向 DeepSeek 方面進行求證,但截至發(fā)稿未獲回應。
按照梁文鋒的說法,華為 950 超節(jié)點在任務層面可以平替英偉達 GB200NVL72 等同類超節(jié)點系統(tǒng),所有后者能做的任務前者都能做,時延表現(xiàn)一致,代價是 4 張華為卡的算力約相當于 1 張英偉達卡,在芯片迭代節(jié)奏上落后約兩年。
超節(jié)點是近年國產(chǎn)算力領(lǐng)域最受關(guān)注的產(chǎn)品方向。它通過專用高速總線將數(shù)十顆乃至數(shù)千顆、數(shù)萬顆 AI 芯片連成緊密協(xié)同的計算系統(tǒng),芯片之間的通信帶寬可達每秒數(shù)百 GB 乃至 TB 級、時延低至納秒級別,使得整柜甚至多柜機器在軟件層面表現(xiàn)得如同一臺超級計算機。和傳統(tǒng)的服務器集群用網(wǎng)線把多臺機器連起來相比,超節(jié)點內(nèi)部芯片之間的通信速度接近芯片內(nèi)部水平,使眾多張卡可像一張卡一樣協(xié)同工作。
隨著大模型參數(shù)從千億走向萬億乃至十萬億,傳統(tǒng) 8 卡服務器(一臺機器裝 8 顆 AI 芯片)已無法滿足訓練和推理的通信需求,超節(jié)點成為各家算力廠商的必選項。
從華為已商用超過 750 套的昇騰 384 超節(jié)點,到今年第四季度計劃上市的 Atlas950(最大可支持 8192 卡滿配),再到中科曙光剛剛落成的十萬卡曙光 8000 超集群,國產(chǎn)廠商已經(jīng)回答了頂尖算力產(chǎn)品有沒有國產(chǎn)替代方案的問題。
梁文鋒作為國內(nèi)頭部大模型公司創(chuàng)始人公開給出 " 可以平替 " 的評價,也在一定程度上打消了市場對國產(chǎn)超節(jié)點實際可用性的疑慮。但國產(chǎn)超節(jié)點的商業(yè)模式怎么落地,這個問題才剛剛浮出水面。
此前超節(jié)點幾乎都以整柜硬件的形式交付給客戶,一套系統(tǒng)少則數(shù)千萬元、多則數(shù)億元,客戶需要自己建機房、自己運維,只有大型互聯(lián)網(wǎng)企業(yè)、電信運營商和國家級智算中心才部署得起。
但這個局面正在改變。7 月 23 日,阿里云宣布靈駿真武 M890 超節(jié)點云上算力單元成功適配 2.4 萬億參數(shù)的 Qwen3.8 模型,并上線百煉平臺提供推理服務。
由此,M890 成為國內(nèi)首個在公共云(面向所有用戶開放、按需付費的云計算平臺,區(qū)別于企業(yè)自建的私有云)上穩(wěn)定運行超兩萬億參數(shù)大模型的超節(jié)點產(chǎn)品。用戶不用自己購買硬件,在阿里云控制臺申請一個 64 卡全互聯(lián)的云上算力單元,按小時付費,每小時 120 元,用完即釋放。
同一時期,中科曙光(603019.SH)自己運營的十萬卡集群接入國家超算互聯(lián)網(wǎng)按使用量向全國用戶收費;華為云宣布從賣云服務器全面轉(zhuǎn)向按詞元(Token)計費。
記者在采訪過程中了解到,國產(chǎn)超節(jié)點的技術(shù)可行性在過去兩年間基本得到了驗證,而商業(yè)模式的分化才剛剛開始,超節(jié)點的交付方式正在從單一的整柜硬件銷售裂變?yōu)槎鄺l路徑——賣整柜、賣算力、賣詞元,不同體量的客戶開始有了不同的選擇。
從 " 造出來 " 到 " 用起來 "
WAIC 期間,昇騰 Atlas950 超節(jié)點這款備受期待的產(chǎn)品終于以真機形態(tài)首次展出,成為全場關(guān)注度最高的展品之一。
記者從華為相關(guān)負責人處了解到,現(xiàn)場展出的 1024 卡版本以單柜 64 卡為基本單元,可提供 1EFLOPS(每秒百億億次浮點運算)的 FP8(一種 AI 計算常用的低精度數(shù)據(jù)格式)算力,配備 256TB 全局統(tǒng)一內(nèi)存,芯片之間的往返通信時延低至 3 微秒。華為還為這套系統(tǒng)自研了名為靈衢 2.0 的互聯(lián)協(xié)議,把跨卡通信時延從傳統(tǒng)網(wǎng)絡(luò)的 2 微秒級降至 200 納秒級,相當于讓上千張卡用同一種 " 語言 " 實時對話。另外,滿配 8192 卡的版本計劃今年四季度批量上市,華為相關(guān)負責人稱已有多家頭部客戶完成鎖單。
根據(jù)華為相關(guān)負責人的介紹,昇騰 384 超節(jié)點是目前國內(nèi)唯一訓練出 SOTA(當前最優(yōu))模型的超節(jié)點,目前已在全球商用超過 750 套,覆蓋互聯(lián)網(wǎng)、運營商、金融、教育、醫(yī)療等行業(yè)。
華為還同期展出了 Atlas850E 風冷超節(jié)點,采用自研 VCE(蒸汽腔均熱)相變散熱技術(shù),可在標準風冷機房里直接部署,無需液冷改造,主要面向推理場景,為沒有液冷條件的企業(yè)降低了部署門檻。
中科曙光要驗證的是另一個維度的問題——當國產(chǎn)芯片的規(guī)模從千卡擴展到十萬卡,系統(tǒng)還能不能長期穩(wěn)定運行?
7 月 10 日,曙光 8000(登峰)十萬卡超集群在鄭州落成運行,同步接入國家超算互聯(lián)網(wǎng),成為中國首個全國產(chǎn)十萬卡 AI 超集群。這套系統(tǒng)搭載海光信息(688041.SH)的 DCU 芯片,配合曙光自研的高速互連網(wǎng)絡(luò)。
中科曙光高端計算總工程師卜景德告訴經(jīng)濟觀察報記者,從萬卡到十萬卡不是簡單增加機器,十萬卡系統(tǒng)瞬間啟動時對電網(wǎng)的功耗沖擊遠超萬卡,整個系統(tǒng)有 30 億個部件,任何一個微小的波動都會影響全局穩(wěn)定性,網(wǎng)絡(luò)故障恢復必須做到秒級。
散熱同樣是工程難題。中科曙光副總裁曹振南介紹,曙光 8000 采用三層循環(huán)冷卻方案,最內(nèi)層用特殊液體蒸發(fā)帶走芯片熱量,最外層直接接入鄭州當?shù)睾M行自然散熱,整套主機系統(tǒng)不需要傳統(tǒng)空調(diào),PUE(一種衡量數(shù)據(jù)中心能源利用效率的指標,數(shù)值越接近 1 說明能源浪費越少)控制在極低水平。
根據(jù)中科曙光方面的介紹,上線首周,曙光 8000 即滿負載運行,日均處理作業(yè)超過 15 萬個,峰值突破 50 萬個。如果將這些算力全部用于大模型推理,可以同時支撐超過百萬人向 AI 提問,并實時獲得回復。
在接受記者采訪時,中國計算機學會(CCF)高性能計算專委會秘書長譚光明亦提到,曙光 8000 對 AIforSci-ence(用 AI 做科學研究)的價值尤為突出,它為國內(nèi)的超智融合研究提供了一個此前不具備的大規(guī)模真實驗證平臺。
在華為和曙光兩家頭部廠商之外,超節(jié)點的熱度在整個產(chǎn)業(yè)鏈上蔓延。根據(jù)記者的不完全統(tǒng)計,本屆 WAIC 上超過 20 家企業(yè)發(fā)布了超節(jié)點相關(guān)方案。
比如,中興通訊(000063.SZ)聯(lián)合壁仞科技、沐曦股份(688802.SH)、燧原科技、天數(shù)智芯等多家國產(chǎn) GPU 廠商推出了支持多芯片混插的 Matrix 超節(jié)點;紫光股份(000938.SZ)旗下新華三(主營企業(yè)級 IT 基礎(chǔ)設(shè)施)發(fā)布了可從 32 卡靈活擴展至 16384 卡的 UniPoDS80000 系列;沐曦股份則發(fā)布了以 64 卡為基本規(guī)格的曦景 S600。
綜合以上情況可以發(fā)現(xiàn),圍繞超節(jié)點有三條技術(shù)路線正在形成:以華為為代表的全棧自研路線,從芯片到互聯(lián)協(xié)議到軟件棧全部基于華為自研;以中興、新華三為代表的兼容路線,支持多家廠商的 GPU 混插部署;沐曦、燧原等芯片廠商聯(lián)合整機廠走的聯(lián)合創(chuàng)新路線。
不只是硬件在推進,軟件生態(tài)的驗證也在同步展開。
摩爾線程(688795.SH)創(chuàng)始人張建中在 WAIC 分論壇上提出了 " 詞元時代 " 的概念框架,并將算力基礎(chǔ)設(shè)施劃分為模型訓練工廠、詞元生產(chǎn)工廠和智能體生產(chǎn)工廠三類。
根據(jù)張建中的介紹,摩爾線程已在基于自研 GPU 芯片 MTTS5000 搭建的萬卡集群上,從零開始完成了一個 2360 億參數(shù) MoE(混合專家,一種讓大模型只激活部分參數(shù)來提升效率的架構(gòu))模型的完整訓練,訓練質(zhì)量可對標國際主流水平。
這亦是國產(chǎn) GPU 廠商首次公開展示如此規(guī)模的模型訓練實踐成果,一定程度上回應了市場對國產(chǎn)芯片能否訓出大模型的疑慮。
在本屆 WAIC 期間,鵬城實驗室和全球計算聯(lián)盟聯(lián)合發(fā)布《超節(jié)點定義與實踐白皮書》,首次給出了超節(jié)點的正式定義,即物理上由多個計算節(jié)點通過高效互聯(lián)協(xié)議緊密連接組成,具備跨物理節(jié)點的統(tǒng)一內(nèi)存編址能力,邏輯上具備 " 一臺計算機 " 特征的計算系統(tǒng)。
白皮書同時明確了超節(jié)點的三大核心技術(shù)特征,分別是內(nèi)存語義互聯(lián)、統(tǒng)一內(nèi)存編址、超低時延超大帶寬。其中," 統(tǒng)一內(nèi)存編址 " 被視為判斷一個系統(tǒng)是否屬于真正超節(jié)點的關(guān)鍵門檻——只有所有芯片能像共享同一塊內(nèi)存一樣讀寫數(shù)據(jù),才能消除芯片間的通信瓶頸,否則系統(tǒng)規(guī)模再大,計算效率也上不去。白皮書提出,未來兩到三年,全球 AI 基礎(chǔ)設(shè)施競爭的主線將從單顆芯片的性能比拼升級為系統(tǒng)級工程能力的競爭。
梁文鋒對國產(chǎn)超節(jié)點生態(tài)的看法比行業(yè)共識更為積極。在前述投資者交流會上,他表示,DeepSeek 訓練 V3 模型時已幾乎不依賴英偉達的軟件生態(tài),而是基于自研的 TileLang 高級編譯器完成了全部工作。
在他看來,英偉達 CUDA 軟件生態(tài)的護城河正在被快速瓦解,原因有三個:AI 本身可以寫代碼來重建生態(tài),TileLang 等高級編譯語言大幅降低了開發(fā)門檻,GPU 從游戲卡衍生的架構(gòu)耦合正在被解綁。
" 國產(chǎn) AI 芯片的硬件和生態(tài)都已沒有根本性障礙,唯一的瓶頸是產(chǎn)能。" 梁文鋒在上述投資者交流會上還透露,華為目前給 DeepSeek 的產(chǎn)能約為 1.6 萬張卡,互聯(lián)網(wǎng)大廠則是十幾萬張。
梁文鋒同時還將中國與美國在 AI 領(lǐng)域的差距概括為 " 落后一到兩年,只用它二十分之一的算力 "。在他看來,這個差距主要由算力資源的不對等造成,而非人才或技術(shù)路線的差異。
三條路徑賣算力
超節(jié)點不只是 AI 芯片的簡單堆疊,一套完整的系統(tǒng)還包括高速交換網(wǎng)絡(luò)、液冷散熱、高壓供電以及將這些部件集成到整柜中的系統(tǒng)工程。
以英偉達為參照,其上一代 GB200NVL72(英偉達 2024 年推出的 72 卡整柜超節(jié)點)售價約 300 萬美元(約合人民幣 2100 萬元),今年量產(chǎn)的新一代 VeraRubinNVL72 單柜物料成本進一步攀升至 780 萬美元。
國產(chǎn)超節(jié)點沒有公開的標準售價,但中國移動今年的集采提供了一個參照—— 776 套超節(jié)點計算節(jié)點設(shè)備,5 家廠商的報價均在 20 億元以上。不過,中國移動采購的是 384 卡規(guī)格的計算節(jié)點,并非整柜系統(tǒng),實際部署時還需要配套交換柜、光模塊和液冷基礎(chǔ)設(shè)施,一個完整的 384 卡超節(jié)點落地總成本遠高于此。
對于電信運營商和互聯(lián)網(wǎng)大廠來說,這是可以承受的基礎(chǔ)設(shè)施投入,但 AI 算力的客戶遠不止這些大買家。高校實驗室、AI 創(chuàng)業(yè)公司、中小開發(fā)團隊同樣需要頂級算力,只是用量有限,也承擔不起高額的一次性投入。
這種需求規(guī)模的落差,正在推動超節(jié)點的交付方式分化為至少三條路徑,既面向不同體量的客戶,也對應不同的盈利邏輯。
第一條路徑是賣整柜硬件。
華為昇騰超節(jié)點目前主要采用這種模式,以整柜形式交付給客戶,客戶在自己的數(shù)據(jù)中心部署運營。買家主要是三大電信運營商、大型互聯(lián)網(wǎng)企業(yè)和國家級智算中心。這些機構(gòu)有機房、有運維團隊、有持續(xù)的算力需求,買硬件自建是最經(jīng)濟的選擇。
比如,中國移動今年 3 月啟動的超節(jié)點集中采購,是目前公開信息中規(guī)模最大的單筆超節(jié)點訂單,也是三大電信運營商在集團層面首次大規(guī)模采購超節(jié)點設(shè)備。此次集采共涉及 776 套超節(jié)點計算節(jié)點設(shè)備和 6208 張 AI 加速卡,全量鎖定華為 CANN(昇騰計算架構(gòu))生態(tài)。根據(jù)中標候選人公示,河南昆侖、長江計算、華鯤振宇、寶德計算機、華啟智慧 5 家廠商入圍,報價集中在 20.59 億至 20.70 億元之間,最高與最低僅差 0.11 億元。
一位長期關(guān)注國產(chǎn)算力領(lǐng)域的投資人告訴記者,這種極度接近的報價反映出硬件環(huán)節(jié)的利潤已經(jīng)被壓得很薄,但首期硬件交付并不是這種模式利潤的主要來源。超節(jié)點把液冷散熱、高速交換、電源管理等模塊整合進了交付范圍,后續(xù)的系統(tǒng)擴容、維保和駐場服務的毛利率通常在 40% 以上,遠高于首期硬件。
公開信息顯示,三大電信運營商 2026 年算力資本開支合計超過 800 億元,其中中國移動算力網(wǎng)絡(luò)投資 378 億元,同比增長 62.4%。
值得一提的是,梁文鋒在前述交流中也透露,DeepSeek 的算力集群全部是自建的,買卡的投資回報遠高于資金留在賬上。" 我把錢變成卡,十個月就能收回成本,肯定是能買到多少就買多少。" 梁文鋒說。
第二條路徑是自建自運營。
曙光 8000 走的就是這條路,十萬卡集群不是賣給某個特定客戶的,是中科曙光自己運營的。這種模式依托國家超算互聯(lián)網(wǎng)運行。超算互聯(lián)網(wǎng)是科技部推動建設(shè)的一張全國性算力調(diào)度網(wǎng)絡(luò),目標是把全國 30 多個超算中心和智算中心連起來,讓用戶在平臺上下單就能按需使用算力,不用關(guān)心算力來自哪個物理機房。
今年 7 月 13 日,超算互聯(lián)網(wǎng)在鄭州上線了核心節(jié)點,定位為全國算力的中央調(diào)度樞紐。平臺注冊用戶目前已突破 140 萬,采用 " 普惠 + 市場 " 雙軌定價,科研用戶注冊即可獲得免費算力額度,商業(yè)客戶按市場價計費。
記者從中科曙光方面了解到,曙光 8000 在鄭州落成后直接接入了這張網(wǎng)絡(luò),面向全國科研機構(gòu)和企業(yè)提供算力服務,定價從每卡時(一張 AI 芯片運行一小時的計費單位)1.2 元到 3.5 元不等,科研機構(gòu)可享受最高 50% 的普惠補貼,補貼后最低每卡時不到 1 元。上線首周,排隊等待使用的算力需求已超過集群總規(guī)模的 3 倍。
這條路徑的盈利邏輯和賣硬件截然不同。前述投資人指出,賣硬件是項目制收入,一臺服務器賣出去就結(jié)束了,毛利率在 20% 左右,且受客戶資本開支周期波動影響;運營算力是持續(xù)性收入,只要集群利用率保持在較高水平,綜合毛利率可以做到 40% 以上。
中科曙光 2025 年年報顯示,算力服務收入占比已從 2023 年的 12% 升至 37%,成為增長最快的業(yè)務板塊。
浙商證券計算機首席分析師劉雯蜀說,算力廠商如果能把盈利模式從一次性的硬件銷售轉(zhuǎn)向持續(xù)性的算力服務,就可以獲得更持續(xù)的現(xiàn)金流。同時,集群運維托管、詞元使用效率提升等增值服務也有望進一步拉高毛利率。
第三條路徑是公共云。
阿里云 M890 超節(jié)點云上算力單元把超節(jié)點做成了按需取用的云服務,64 卡全互聯(lián)的云上算力單元每小時 120 元,平均每卡時不到 2 元,同時支持按任務包和按詞元調(diào)用量計費。
阿里云彈性計算產(chǎn)品線負責人吳結(jié)生在 WAIC 期間表示,當一個萬億參數(shù)的大模型需要更高效的推理,當訓練任務動輒橫跨成百上千張卡,真正的答案是把芯片、服務器、網(wǎng)絡(luò)、存儲凝聚成一個整體,提供一臺能訓練、能推理、能被開箱即用的 "AI 超級計算機 "。
在阿里云的設(shè)計中,用戶不需要自己去買硬件、建機房,只需要在云平臺上開通,就能直接獲得一個超節(jié)點計算環(huán)境來跑大模型。
華為云也在朝類似方向演進。華為云 CEO 張平安此前曾公開表示,華為云已從賣云服務器的 IaaS(基礎(chǔ)設(shè)施即服務)模式全面轉(zhuǎn)向賣詞元的 MaaS(模型即服務)模式。公開數(shù)據(jù)顯示,華為云基于昇騰 384 超節(jié)點推出的 CloudMatrix384(華為云超節(jié)點云服務的產(chǎn)品名稱)每百萬詞元成本約為 1.8 元,在國產(chǎn)算力方案中具備較強的價格競爭力。
當然,上述幾種路徑之間也存在交叉互滲。比如,華為既通過整柜銷售服務于運營商,又通過華為云的 MaaS 模式服務中小客戶;曙光既自己運營算力集群,也向其他智算中心銷售超節(jié)點硬件和整體解決方案。
或者說,不同路徑面向不同客戶形成了分層結(jié)構(gòu):大型運營商和互聯(lián)網(wǎng)企業(yè)有機房、有團隊、有持續(xù)需求,買整柜自建最經(jīng)濟;中型企業(yè)和科研機構(gòu)算力需求波動較大,按需租用可以避免重資產(chǎn)投入和設(shè)備閑置;中小開發(fā)者在公共云上按小時付費,幾百塊錢就能用上此前只有大廠才能接觸到的頂級算力,靈活方便。
向 " 訓推一體的通用算力底座 " 演進
算力能不能持續(xù)高效運轉(zhuǎn),正在成為決定這個市場能否兌現(xiàn)商業(yè)回報的核心變量。
曙光 8000 上線首周滿載是好消息,但并非所有智算中心都有這樣的需求支撐。根據(jù)工信部 7 月 20 日在國新辦新聞發(fā)布會上公布的數(shù)據(jù),截至今年 6 月底,全國智能算力規(guī)模達 2185EFLOPS,其中東部地區(qū)占比 55.9%,西部地區(qū)占 32.6%,中部地區(qū)僅占 10.6%。對此,一位長期關(guān)注算力領(lǐng)域的投資人告訴記者,東部智算中心普遍處于高負荷運行狀態(tài),而中西部部分智算中心建成后面臨客戶不足、利用率偏低的情況,算力越高端、密度越大,閑置的成本壓力也越大。
智算中心的電費、運維、帶寬、折舊等運營成本是剛性支出,集群規(guī)模越大每天的固定開銷越高,利用率低于一定門檻就意味著持續(xù)虧損。尤其是對于剛剛轉(zhuǎn)型為算力運營商的企業(yè)來說,如何在建成之后持續(xù)找到足夠多的客戶、維持足夠高的利用率,是比技術(shù)更難回答的問題。
國家超算互聯(lián)網(wǎng)正在嘗試緩解這種供需的地理錯配。
7 月 13 日上線運行的鄭州核心節(jié)點定位為全國算力的中央調(diào)度樞紐,用戶不管在哪個城市,接入平臺就能按需調(diào)用全國的算力資源。在采訪過程中,記者了解到,預計 2026 年底,國家超算互聯(lián)網(wǎng)年算力交易額就將突破 100 億元。另外,落地了中央調(diào)度樞紐的河南省也在省級層面建立了算力券機制,每年發(fā)放總額不超過 5000 萬元,以降低中小企業(yè)的用算成本。
從需求端看,新的應用場景也正在創(chuàng)造增量需求。
海光信息總裁助理兼智能計算產(chǎn)品部總經(jīng)理杜夏威在接受記者采訪時提到,AIAgent(智能體,能自主規(guī)劃和執(zhí)行復雜任務的 AI 系統(tǒng))的興起正在改變算力需求結(jié)構(gòu)。過去 AI 主要用 GPU 做模型推理,CPU 只起輔助調(diào)度作用,但 Agent 在執(zhí)行一個復雜任務時,需要 CPU 完成任務編排、工具調(diào)用、緩存管理等大量工作,CPU 和 GPU 的算力配比正從過去的 1:8 向 1:1、甚至更高的方向變化。這意味著算力基礎(chǔ)設(shè)施的需求不是在減少,而是在變得更加多元。
中科曙光 AI 行業(yè)首席工程師李冉亦認為,Agent 時代的負載是長鏈路、高消耗的,要求計算、存儲、網(wǎng)絡(luò)、軟件整體協(xié)同,曙光的應對方式是圍繞超節(jié)點打造全鏈路推理加速方案,從底層算子庫到上層模型部署做端到端的全鏈路優(yōu)化。
在他看來,超節(jié)點正從 " 訓練專用設(shè)施 " 向 " 訓推一體的通用算力底座 " 演進,應用場景已從大模型訓練擴展至推理、Agent、科學計算等更多領(lǐng)域。
工信部信息通信經(jīng)濟專家委員會委員盤和林對經(jīng)濟觀察報記者表示,超節(jié)點與傳統(tǒng) GPU 算力集群的本質(zhì)差異在于是否實現(xiàn)了內(nèi)存統(tǒng)一編址與垂直擴展級互聯(lián)。傳統(tǒng) GPU 算力集群采用橫向擴展,時延高、帶寬低,而超節(jié)點通過構(gòu)建統(tǒng)一內(nèi)存編址,時延可低至微秒級,帶寬可達每秒 TB 級別,并可以直接訪問跨節(jié)點資源。
" 簡單來說,超節(jié)點彌補了國產(chǎn)算力單芯片性能不足的短板,使我們追平全球先進算力水平成為可能。" 盤和林說。
不過,在盤和林看來,國產(chǎn)超節(jié)點要真正大規(guī)模商用,還需要跨越兩個障礙。一是生態(tài)適配,目前各廠商的超節(jié)點之間存在不同的連接協(xié)議,如何統(tǒng)一這些協(xié)議以充分發(fā)揮互聯(lián)效率,同時針對 DeepSeekV4、Qwen、GLM 等主流大模型完成適配并降低開發(fā)者的適配門檻、避免重復開發(fā),仍是行業(yè)需要解答的問題;二是在提高系統(tǒng)可靠性的同時優(yōu)化成本,千卡乃至萬卡同時接入超節(jié)點可能導致系統(tǒng)整體穩(wěn)定性下降,需要完善故障響應和自愈等配套機制,而算力成本的下降則有賴于節(jié)點規(guī)模化和單節(jié)點成本的持續(xù)壓降,以此吸引更多 AI 大模型用戶接入超節(jié)點網(wǎng)絡(luò)。
國泰海通證券計算機首席分析師楊林告訴記者,算力競爭的核心范式已從 " 單卡峰值 " 轉(zhuǎn)向 " 系統(tǒng)效率 ",價值分配正從 " 賣卡 " 向 " 賣系統(tǒng)、賣能力 " 全面遷移,光互連、液冷、網(wǎng)絡(luò)方案、系統(tǒng)集成與調(diào)度軟件等環(huán)節(jié)將獲得更高的價值權(quán)重。
根據(jù)華泰證券在相關(guān)研報中的測算,2028 年中國超節(jié)點架構(gòu)市場規(guī)模有望達到 3414 億元,2026 至 2028 年復合年均增長率為 194%。