
在 7 月 17 日至 20 日舉行的 2026 世界人工智能大會(huì)(WAIC)上,超節(jié)點(diǎn)成為全場(chǎng)焦點(diǎn)。據(jù)記者不完全梳理,超過(guò) 20 家企業(yè)發(fā)布了與超節(jié)點(diǎn)相關(guān)的產(chǎn)品或方案。
早在 2025 年 9 月的華為全聯(lián)接大會(huì)上,昇騰 Atlas950 超節(jié)點(diǎn)首次發(fā)布,但當(dāng)時(shí)外界只看到了產(chǎn)品參數(shù)和渲染圖,真機(jī)并未露面。此后近一年,950 超節(jié)點(diǎn)的實(shí)際性能表現(xiàn)、量產(chǎn)進(jìn)度是否如期推進(jìn)等,一直是關(guān)注國(guó)產(chǎn)算力的投資人和產(chǎn)業(yè)人士追問(wèn)的焦點(diǎn)。
" 貴百分之一百無(wú)所謂,貴百分之兩百都無(wú)所謂。"
今年 7 月,一份 DeepSeek 創(chuàng)始人梁文鋒在兩個(gè)月前舉辦的投資者交流會(huì)上發(fā)言的錄音文字稿開(kāi)始在投資圈流傳。在這份近四小時(shí)的交流記錄中,梁文鋒談到華為超節(jié)點(diǎn)與英偉達(dá)產(chǎn)品的價(jià)格差距時(shí)作出了上述表態(tài)。
梁文鋒還就 DeepSeek 的開(kāi)源策略、AGI(通用人工智能)技術(shù)路線圖、API(應(yīng)用程序接口,外部用戶調(diào)用 AI 模型能力的技術(shù)通道)定價(jià)邏輯以及中美算力差距和國(guó)產(chǎn)芯片替代前景等話題發(fā)表了看法,其中關(guān)于國(guó)產(chǎn)算力的評(píng)價(jià)在網(wǎng)絡(luò)上引發(fā)了廣泛討論。
一位接近 DeepSeek 投資方的知情人士向經(jīng)濟(jì)觀察報(bào)記者確認(rèn)了該文字稿的真實(shí)性。7 月 24 日,記者亦通過(guò)電話和郵件的方式就這份錄音文字稿的真實(shí)性向 DeepSeek 方面進(jìn)行求證,但截至發(fā)稿未獲回應(yīng)。
按照梁文鋒的說(shuō)法,華為 950 超節(jié)點(diǎn)在任務(wù)層面可以平替英偉達(dá) GB200NVL72 等同類超節(jié)點(diǎn)系統(tǒng),所有后者能做的任務(wù)前者都能做,時(shí)延表現(xiàn)一致,代價(jià)是 4 張華為卡的算力約相當(dāng)于 1 張英偉達(dá)卡,在芯片迭代節(jié)奏上落后約兩年。
超節(jié)點(diǎn)是近年國(guó)產(chǎn)算力領(lǐng)域最受關(guān)注的產(chǎn)品方向。它通過(guò)專用高速總線將數(shù)十顆乃至數(shù)千顆、數(shù)萬(wàn)顆 AI 芯片連成緊密協(xié)同的計(jì)算系統(tǒng),芯片之間的通信帶寬可達(dá)每秒數(shù)百 GB 乃至 TB 級(jí)、時(shí)延低至納秒級(jí)別,使得整柜甚至多柜機(jī)器在軟件層面表現(xiàn)得如同一臺(tái)超級(jí)計(jì)算機(jī)。和傳統(tǒng)的服務(wù)器集群用網(wǎng)線把多臺(tái)機(jī)器連起來(lái)相比,超節(jié)點(diǎn)內(nèi)部芯片之間的通信速度接近芯片內(nèi)部水平,使眾多張卡可像一張卡一樣協(xié)同工作。
隨著大模型參數(shù)從千億走向萬(wàn)億乃至十萬(wàn)億,傳統(tǒng) 8 卡服務(wù)器(一臺(tái)機(jī)器裝 8 顆 AI 芯片)已無(wú)法滿足訓(xùn)練和推理的通信需求,超節(jié)點(diǎn)成為各家算力廠商的必選項(xiàng)。
從華為已商用超過(guò) 750 套的昇騰 384 超節(jié)點(diǎn),到今年第四季度計(jì)劃上市的 Atlas950(最大可支持 8192 卡滿配),再到中科曙光剛剛落成的十萬(wàn)卡曙光 8000 超集群,國(guó)產(chǎn)廠商已經(jīng)回答了頂尖算力產(chǎn)品有沒(méi)有國(guó)產(chǎn)替代方案的問(wèn)題。
梁文鋒作為國(guó)內(nèi)頭部大模型公司創(chuàng)始人公開(kāi)給出 " 可以平替 " 的評(píng)價(jià),也在一定程度上打消了市場(chǎng)對(duì)國(guó)產(chǎn)超節(jié)點(diǎn)實(shí)際可用性的疑慮。但國(guó)產(chǎn)超節(jié)點(diǎn)的商業(yè)模式怎么落地,這個(gè)問(wèn)題才剛剛浮出水面。
此前超節(jié)點(diǎn)幾乎都以整柜硬件的形式交付給客戶,一套系統(tǒng)少則數(shù)千萬(wàn)元、多則數(shù)億元,客戶需要自己建機(jī)房、自己運(yùn)維,只有大型互聯(lián)網(wǎng)企業(yè)、電信運(yùn)營(yíng)商和國(guó)家級(jí)智算中心才部署得起。
但這個(gè)局面正在改變。7 月 23 日,阿里云宣布靈駿真武 M890 超節(jié)點(diǎn)云上算力單元成功適配 2.4 萬(wàn)億參數(shù)的 Qwen3.8 模型,并上線百煉平臺(tái)提供推理服務(wù)。
由此,M890 成為國(guó)內(nèi)首個(gè)在公共云(面向所有用戶開(kāi)放、按需付費(fèi)的云計(jì)算平臺(tái),區(qū)別于企業(yè)自建的私有云)上穩(wěn)定運(yùn)行超兩萬(wàn)億參數(shù)大模型的超節(jié)點(diǎn)產(chǎn)品。用戶不用自己購(gòu)買(mǎi)硬件,在阿里云控制臺(tái)申請(qǐng)一個(gè) 64 卡全互聯(lián)的云上算力單元,按小時(shí)付費(fèi),每小時(shí) 120 元,用完即釋放。
同一時(shí)期,中科曙光(603019.SH)自己運(yùn)營(yíng)的十萬(wàn)卡集群接入國(guó)家超算互聯(lián)網(wǎng)按使用量向全國(guó)用戶收費(fèi);華為云宣布從賣(mài)云服務(wù)器全面轉(zhuǎn)向按詞元(Token)計(jì)費(fèi)。
記者在采訪過(guò)程中了解到,國(guó)產(chǎn)超節(jié)點(diǎn)的技術(shù)可行性在過(guò)去兩年間基本得到了驗(yàn)證,而商業(yè)模式的分化才剛剛開(kāi)始,超節(jié)點(diǎn)的交付方式正在從單一的整柜硬件銷售裂變?yōu)槎鄺l路徑——賣(mài)整柜、賣(mài)算力、賣(mài)詞元,不同體量的客戶開(kāi)始有了不同的選擇。
從 " 造出來(lái) " 到 " 用起來(lái) "
WAIC 期間,昇騰 Atlas950 超節(jié)點(diǎn)這款備受期待的產(chǎn)品終于以真機(jī)形態(tài)首次展出,成為全場(chǎng)關(guān)注度最高的展品之一。
記者從華為相關(guān)負(fù)責(zé)人處了解到,現(xiàn)場(chǎng)展出的 1024 卡版本以單柜 64 卡為基本單元,可提供 1EFLOPS(每秒百億億次浮點(diǎn)運(yùn)算)的 FP8(一種 AI 計(jì)算常用的低精度數(shù)據(jù)格式)算力,配備 256TB 全局統(tǒng)一內(nèi)存,芯片之間的往返通信時(shí)延低至 3 微秒。華為還為這套系統(tǒng)自研了名為靈衢 2.0 的互聯(lián)協(xié)議,把跨卡通信時(shí)延從傳統(tǒng)網(wǎng)絡(luò)的 2 微秒級(jí)降至 200 納秒級(jí),相當(dāng)于讓上千張卡用同一種 " 語(yǔ)言 " 實(shí)時(shí)對(duì)話。另外,滿配 8192 卡的版本計(jì)劃今年四季度批量上市,華為相關(guān)負(fù)責(zé)人稱已有多家頭部客戶完成鎖單。
根據(jù)華為相關(guān)負(fù)責(zé)人的介紹,昇騰 384 超節(jié)點(diǎn)是目前國(guó)內(nèi)唯一訓(xùn)練出 SOTA(當(dāng)前最優(yōu))模型的超節(jié)點(diǎn),目前已在全球商用超過(guò) 750 套,覆蓋互聯(lián)網(wǎng)、運(yùn)營(yíng)商、金融、教育、醫(yī)療等行業(yè)。
華為還同期展出了 Atlas850E 風(fēng)冷超節(jié)點(diǎn),采用自研 VCE(蒸汽腔均熱)相變散熱技術(shù),可在標(biāo)準(zhǔn)風(fēng)冷機(jī)房里直接部署,無(wú)需液冷改造,主要面向推理場(chǎng)景,為沒(méi)有液冷條件的企業(yè)降低了部署門(mén)檻。
中科曙光要驗(yàn)證的是另一個(gè)維度的問(wèn)題——當(dāng)國(guó)產(chǎn)芯片的規(guī)模從千卡擴(kuò)展到十萬(wàn)卡,系統(tǒng)還能不能長(zhǎng)期穩(wěn)定運(yùn)行?
7 月 10 日,曙光 8000(登峰)十萬(wàn)卡超集群在鄭州落成運(yùn)行,同步接入國(guó)家超算互聯(lián)網(wǎng),成為中國(guó)首個(gè)全國(guó)產(chǎn)十萬(wàn)卡 AI 超集群。這套系統(tǒng)搭載海光信息(688041.SH)的 DCU 芯片,配合曙光自研的高速互連網(wǎng)絡(luò)。
中科曙光高端計(jì)算總工程師卜景德告訴經(jīng)濟(jì)觀察報(bào)記者,從萬(wàn)卡到十萬(wàn)卡不是簡(jiǎn)單增加機(jī)器,十萬(wàn)卡系統(tǒng)瞬間啟動(dòng)時(shí)對(duì)電網(wǎng)的功耗沖擊遠(yuǎn)超萬(wàn)卡,整個(gè)系統(tǒng)有 30 億個(gè)部件,任何一個(gè)微小的波動(dòng)都會(huì)影響全局穩(wěn)定性,網(wǎng)絡(luò)故障恢復(fù)必須做到秒級(jí)。
散熱同樣是工程難題。中科曙光副總裁曹振南介紹,曙光 8000 采用三層循環(huán)冷卻方案,最內(nèi)層用特殊液體蒸發(fā)帶走芯片熱量,最外層直接接入鄭州當(dāng)?shù)睾M(jìn)行自然散熱,整套主機(jī)系統(tǒng)不需要傳統(tǒng)空調(diào),PUE(一種衡量數(shù)據(jù)中心能源利用效率的指標(biāo),數(shù)值越接近 1 說(shuō)明能源浪費(fèi)越少)控制在極低水平。
根據(jù)中科曙光方面的介紹,上線首周,曙光 8000 即滿負(fù)載運(yùn)行,日均處理作業(yè)超過(guò) 15 萬(wàn)個(gè),峰值突破 50 萬(wàn)個(gè)。如果將這些算力全部用于大模型推理,可以同時(shí)支撐超過(guò)百萬(wàn)人向 AI 提問(wèn),并實(shí)時(shí)獲得回復(fù)。
在接受記者采訪時(shí),中國(guó)計(jì)算機(jī)學(xué)會(huì)(CCF)高性能計(jì)算專委會(huì)秘書(shū)長(zhǎng)譚光明亦提到,曙光 8000 對(duì) AIforSci-ence(用 AI 做科學(xué)研究)的價(jià)值尤為突出,它為國(guó)內(nèi)的超智融合研究提供了一個(gè)此前不具備的大規(guī)模真實(shí)驗(yàn)證平臺(tái)。
在華為和曙光兩家頭部廠商之外,超節(jié)點(diǎn)的熱度在整個(gè)產(chǎn)業(yè)鏈上蔓延。根據(jù)記者的不完全統(tǒng)計(jì),本屆 WAIC 上超過(guò) 20 家企業(yè)發(fā)布了超節(jié)點(diǎn)相關(guān)方案。
比如,中興通訊(000063.SZ)聯(lián)合壁仞科技、沐曦股份(688802.SH)、燧原科技、天數(shù)智芯等多家國(guó)產(chǎn) GPU 廠商推出了支持多芯片混插的 Matrix 超節(jié)點(diǎn);紫光股份(000938.SZ)旗下新華三(主營(yíng)企業(yè)級(jí) IT 基礎(chǔ)設(shè)施)發(fā)布了可從 32 卡靈活擴(kuò)展至 16384 卡的 UniPoDS80000 系列;沐曦股份則發(fā)布了以 64 卡為基本規(guī)格的曦景 S600。
綜合以上情況可以發(fā)現(xiàn),圍繞超節(jié)點(diǎn)有三條技術(shù)路線正在形成:以華為為代表的全棧自研路線,從芯片到互聯(lián)協(xié)議到軟件棧全部基于華為自研;以中興、新華三為代表的兼容路線,支持多家廠商的 GPU 混插部署;沐曦、燧原等芯片廠商聯(lián)合整機(jī)廠走的聯(lián)合創(chuàng)新路線。
不只是硬件在推進(jìn),軟件生態(tài)的驗(yàn)證也在同步展開(kāi)。
摩爾線程(688795.SH)創(chuàng)始人張建中在 WAIC 分論壇上提出了 " 詞元時(shí)代 " 的概念框架,并將算力基礎(chǔ)設(shè)施劃分為模型訓(xùn)練工廠、詞元生產(chǎn)工廠和智能體生產(chǎn)工廠三類。
根據(jù)張建中的介紹,摩爾線程已在基于自研 GPU 芯片 MTTS5000 搭建的萬(wàn)卡集群上,從零開(kāi)始完成了一個(gè) 2360 億參數(shù) MoE(混合專家,一種讓大模型只激活部分參數(shù)來(lái)提升效率的架構(gòu))模型的完整訓(xùn)練,訓(xùn)練質(zhì)量可對(duì)標(biāo)國(guó)際主流水平。
這亦是國(guó)產(chǎn) GPU 廠商首次公開(kāi)展示如此規(guī)模的模型訓(xùn)練實(shí)踐成果,一定程度上回應(yīng)了市場(chǎng)對(duì)國(guó)產(chǎn)芯片能否訓(xùn)出大模型的疑慮。
在本屆 WAIC 期間,鵬城實(shí)驗(yàn)室和全球計(jì)算聯(lián)盟聯(lián)合發(fā)布《超節(jié)點(diǎn)定義與實(shí)踐白皮書(shū)》,首次給出了超節(jié)點(diǎn)的正式定義,即物理上由多個(gè)計(jì)算節(jié)點(diǎn)通過(guò)高效互聯(lián)協(xié)議緊密連接組成,具備跨物理節(jié)點(diǎn)的統(tǒng)一內(nèi)存編址能力,邏輯上具備 " 一臺(tái)計(jì)算機(jī) " 特征的計(jì)算系統(tǒng)。
白皮書(shū)同時(shí)明確了超節(jié)點(diǎn)的三大核心技術(shù)特征,分別是內(nèi)存語(yǔ)義互聯(lián)、統(tǒng)一內(nèi)存編址、超低時(shí)延超大帶寬。其中," 統(tǒng)一內(nèi)存編址 " 被視為判斷一個(gè)系統(tǒng)是否屬于真正超節(jié)點(diǎn)的關(guān)鍵門(mén)檻——只有所有芯片能像共享同一塊內(nèi)存一樣讀寫(xiě)數(shù)據(jù),才能消除芯片間的通信瓶頸,否則系統(tǒng)規(guī)模再大,計(jì)算效率也上不去。白皮書(shū)提出,未來(lái)兩到三年,全球 AI 基礎(chǔ)設(shè)施競(jìng)爭(zhēng)的主線將從單顆芯片的性能比拼升級(jí)為系統(tǒng)級(jí)工程能力的競(jìng)爭(zhēng)。
梁文鋒對(duì)國(guó)產(chǎn)超節(jié)點(diǎn)生態(tài)的看法比行業(yè)共識(shí)更為積極。在前述投資者交流會(huì)上,他表示,DeepSeek 訓(xùn)練 V3 模型時(shí)已幾乎不依賴英偉達(dá)的軟件生態(tài),而是基于自研的 TileLang 高級(jí)編譯器完成了全部工作。
在他看來(lái),英偉達(dá) CUDA 軟件生態(tài)的護(hù)城河正在被快速瓦解,原因有三個(gè):AI 本身可以寫(xiě)代碼來(lái)重建生態(tài),TileLang 等高級(jí)編譯語(yǔ)言大幅降低了開(kāi)發(fā)門(mén)檻,GPU 從游戲卡衍生的架構(gòu)耦合正在被解綁。
" 國(guó)產(chǎn) AI 芯片的硬件和生態(tài)都已沒(méi)有根本性障礙,唯一的瓶頸是產(chǎn)能。" 梁文鋒在上述投資者交流會(huì)上還透露,華為目前給 DeepSeek 的產(chǎn)能約為 1.6 萬(wàn)張卡,互聯(lián)網(wǎng)大廠則是十幾萬(wàn)張。
梁文鋒同時(shí)還將中國(guó)與美國(guó)在 AI 領(lǐng)域的差距概括為 " 落后一到兩年,只用它二十分之一的算力 "。在他看來(lái),這個(gè)差距主要由算力資源的不對(duì)等造成,而非人才或技術(shù)路線的差異。
三條路徑賣(mài)算力
超節(jié)點(diǎn)不只是 AI 芯片的簡(jiǎn)單堆疊,一套完整的系統(tǒng)還包括高速交換網(wǎng)絡(luò)、液冷散熱、高壓供電以及將這些部件集成到整柜中的系統(tǒng)工程。
以英偉達(dá)為參照,其上一代 GB200NVL72(英偉達(dá) 2024 年推出的 72 卡整柜超節(jié)點(diǎn))售價(jià)約 300 萬(wàn)美元(約合人民幣 2100 萬(wàn)元),今年量產(chǎn)的新一代 VeraRubinNVL72 單柜物料成本進(jìn)一步攀升至 780 萬(wàn)美元。
國(guó)產(chǎn)超節(jié)點(diǎn)沒(méi)有公開(kāi)的標(biāo)準(zhǔn)售價(jià),但中國(guó)移動(dòng)今年的集采提供了一個(gè)參照—— 776 套超節(jié)點(diǎn)計(jì)算節(jié)點(diǎn)設(shè)備,5 家廠商的報(bào)價(jià)均在 20 億元以上。不過(guò),中國(guó)移動(dòng)采購(gòu)的是 384 卡規(guī)格的計(jì)算節(jié)點(diǎn),并非整柜系統(tǒng),實(shí)際部署時(shí)還需要配套交換柜、光模塊和液冷基礎(chǔ)設(shè)施,一個(gè)完整的 384 卡超節(jié)點(diǎn)落地總成本遠(yuǎn)高于此。
對(duì)于電信運(yùn)營(yíng)商和互聯(lián)網(wǎng)大廠來(lái)說(shuō),這是可以承受的基礎(chǔ)設(shè)施投入,但 AI 算力的客戶遠(yuǎn)不止這些大買(mǎi)家。高校實(shí)驗(yàn)室、AI 創(chuàng)業(yè)公司、中小開(kāi)發(fā)團(tuán)隊(duì)同樣需要頂級(jí)算力,只是用量有限,也承擔(dān)不起高額的一次性投入。
這種需求規(guī)模的落差,正在推動(dòng)超節(jié)點(diǎn)的交付方式分化為至少三條路徑,既面向不同體量的客戶,也對(duì)應(yīng)不同的盈利邏輯。
第一條路徑是賣(mài)整柜硬件。
華為昇騰超節(jié)點(diǎn)目前主要采用這種模式,以整柜形式交付給客戶,客戶在自己的數(shù)據(jù)中心部署運(yùn)營(yíng)。買(mǎi)家主要是三大電信運(yùn)營(yíng)商、大型互聯(lián)網(wǎng)企業(yè)和國(guó)家級(jí)智算中心。這些機(jī)構(gòu)有機(jī)房、有運(yùn)維團(tuán)隊(duì)、有持續(xù)的算力需求,買(mǎi)硬件自建是最經(jīng)濟(jì)的選擇。
比如,中國(guó)移動(dòng)今年 3 月啟動(dòng)的超節(jié)點(diǎn)集中采購(gòu),是目前公開(kāi)信息中規(guī)模最大的單筆超節(jié)點(diǎn)訂單,也是三大電信運(yùn)營(yíng)商在集團(tuán)層面首次大規(guī)模采購(gòu)超節(jié)點(diǎn)設(shè)備。此次集采共涉及 776 套超節(jié)點(diǎn)計(jì)算節(jié)點(diǎn)設(shè)備和 6208 張 AI 加速卡,全量鎖定華為 CANN(昇騰計(jì)算架構(gòu))生態(tài)。根據(jù)中標(biāo)候選人公示,河南昆侖、長(zhǎng)江計(jì)算、華鯤振宇、寶德計(jì)算機(jī)、華啟智慧 5 家廠商入圍,報(bào)價(jià)集中在 20.59 億至 20.70 億元之間,最高與最低僅差 0.11 億元。
一位長(zhǎng)期關(guān)注國(guó)產(chǎn)算力領(lǐng)域的投資人告訴記者,這種極度接近的報(bào)價(jià)反映出硬件環(huán)節(jié)的利潤(rùn)已經(jīng)被壓得很薄,但首期硬件交付并不是這種模式利潤(rùn)的主要來(lái)源。超節(jié)點(diǎn)把液冷散熱、高速交換、電源管理等模塊整合進(jìn)了交付范圍,后續(xù)的系統(tǒng)擴(kuò)容、維保和駐場(chǎng)服務(wù)的毛利率通常在 40% 以上,遠(yuǎn)高于首期硬件。
公開(kāi)信息顯示,三大電信運(yùn)營(yíng)商 2026 年算力資本開(kāi)支合計(jì)超過(guò) 800 億元,其中中國(guó)移動(dòng)算力網(wǎng)絡(luò)投資 378 億元,同比增長(zhǎng) 62.4%。
值得一提的是,梁文鋒在前述交流中也透露,DeepSeek 的算力集群全部是自建的,買(mǎi)卡的投資回報(bào)遠(yuǎn)高于資金留在賬上。" 我把錢(qián)變成卡,十個(gè)月就能收回成本,肯定是能買(mǎi)到多少就買(mǎi)多少。" 梁文鋒說(shuō)。
第二條路徑是自建自運(yùn)營(yíng)。
曙光 8000 走的就是這條路,十萬(wàn)卡集群不是賣(mài)給某個(gè)特定客戶的,是中科曙光自己運(yùn)營(yíng)的。這種模式依托國(guó)家超算互聯(lián)網(wǎng)運(yùn)行。超算互聯(lián)網(wǎng)是科技部推動(dòng)建設(shè)的一張全國(guó)性算力調(diào)度網(wǎng)絡(luò),目標(biāo)是把全國(guó) 30 多個(gè)超算中心和智算中心連起來(lái),讓用戶在平臺(tái)上下單就能按需使用算力,不用關(guān)心算力來(lái)自哪個(gè)物理機(jī)房。
今年 7 月 13 日,超算互聯(lián)網(wǎng)在鄭州上線了核心節(jié)點(diǎn),定位為全國(guó)算力的中央調(diào)度樞紐。平臺(tái)注冊(cè)用戶目前已突破 140 萬(wàn),采用 " 普惠 + 市場(chǎng) " 雙軌定價(jià),科研用戶注冊(cè)即可獲得免費(fèi)算力額度,商業(yè)客戶按市場(chǎng)價(jià)計(jì)費(fèi)。
記者從中科曙光方面了解到,曙光 8000 在鄭州落成后直接接入了這張網(wǎng)絡(luò),面向全國(guó)科研機(jī)構(gòu)和企業(yè)提供算力服務(wù),定價(jià)從每卡時(shí)(一張 AI 芯片運(yùn)行一小時(shí)的計(jì)費(fèi)單位)1.2 元到 3.5 元不等,科研機(jī)構(gòu)可享受最高 50% 的普惠補(bǔ)貼,補(bǔ)貼后最低每卡時(shí)不到 1 元。上線首周,排隊(duì)等待使用的算力需求已超過(guò)集群總規(guī)模的 3 倍。
這條路徑的盈利邏輯和賣(mài)硬件截然不同。前述投資人指出,賣(mài)硬件是項(xiàng)目制收入,一臺(tái)服務(wù)器賣(mài)出去就結(jié)束了,毛利率在 20% 左右,且受客戶資本開(kāi)支周期波動(dòng)影響;運(yùn)營(yíng)算力是持續(xù)性收入,只要集群利用率保持在較高水平,綜合毛利率可以做到 40% 以上。
中科曙光 2025 年年報(bào)顯示,算力服務(wù)收入占比已從 2023 年的 12% 升至 37%,成為增長(zhǎng)最快的業(yè)務(wù)板塊。
浙商證券計(jì)算機(jī)首席分析師劉雯蜀說(shuō),算力廠商如果能把盈利模式從一次性的硬件銷售轉(zhuǎn)向持續(xù)性的算力服務(wù),就可以獲得更持續(xù)的現(xiàn)金流。同時(shí),集群運(yùn)維托管、詞元使用效率提升等增值服務(wù)也有望進(jìn)一步拉高毛利率。
第三條路徑是公共云。
阿里云 M890 超節(jié)點(diǎn)云上算力單元把超節(jié)點(diǎn)做成了按需取用的云服務(wù),64 卡全互聯(lián)的云上算力單元每小時(shí) 120 元,平均每卡時(shí)不到 2 元,同時(shí)支持按任務(wù)包和按詞元調(diào)用量計(jì)費(fèi)。
阿里云彈性計(jì)算產(chǎn)品線負(fù)責(zé)人吳結(jié)生在 WAIC 期間表示,當(dāng)一個(gè)萬(wàn)億參數(shù)的大模型需要更高效的推理,當(dāng)訓(xùn)練任務(wù)動(dòng)輒橫跨成百上千張卡,真正的答案是把芯片、服務(wù)器、網(wǎng)絡(luò)、存儲(chǔ)凝聚成一個(gè)整體,提供一臺(tái)能訓(xùn)練、能推理、能被開(kāi)箱即用的 "AI 超級(jí)計(jì)算機(jī) "。
在阿里云的設(shè)計(jì)中,用戶不需要自己去買(mǎi)硬件、建機(jī)房,只需要在云平臺(tái)上開(kāi)通,就能直接獲得一個(gè)超節(jié)點(diǎn)計(jì)算環(huán)境來(lái)跑大模型。
華為云也在朝類似方向演進(jìn)。華為云 CEO 張平安此前曾公開(kāi)表示,華為云已從賣(mài)云服務(wù)器的 IaaS(基礎(chǔ)設(shè)施即服務(wù))模式全面轉(zhuǎn)向賣(mài)詞元的 MaaS(模型即服務(wù))模式。公開(kāi)數(shù)據(jù)顯示,華為云基于昇騰 384 超節(jié)點(diǎn)推出的 CloudMatrix384(華為云超節(jié)點(diǎn)云服務(wù)的產(chǎn)品名稱)每百萬(wàn)詞元成本約為 1.8 元,在國(guó)產(chǎn)算力方案中具備較強(qiáng)的價(jià)格競(jìng)爭(zhēng)力。
當(dāng)然,上述幾種路徑之間也存在交叉互滲。比如,華為既通過(guò)整柜銷售服務(wù)于運(yùn)營(yíng)商,又通過(guò)華為云的 MaaS 模式服務(wù)中小客戶;曙光既自己運(yùn)營(yíng)算力集群,也向其他智算中心銷售超節(jié)點(diǎn)硬件和整體解決方案。
或者說(shuō),不同路徑面向不同客戶形成了分層結(jié)構(gòu):大型運(yùn)營(yíng)商和互聯(lián)網(wǎng)企業(yè)有機(jī)房、有團(tuán)隊(duì)、有持續(xù)需求,買(mǎi)整柜自建最經(jīng)濟(jì);中型企業(yè)和科研機(jī)構(gòu)算力需求波動(dòng)較大,按需租用可以避免重資產(chǎn)投入和設(shè)備閑置;中小開(kāi)發(fā)者在公共云上按小時(shí)付費(fèi),幾百塊錢(qián)就能用上此前只有大廠才能接觸到的頂級(jí)算力,靈活方便。
向 " 訓(xùn)推一體的通用算力底座 " 演進(jìn)
算力能不能持續(xù)高效運(yùn)轉(zhuǎn),正在成為決定這個(gè)市場(chǎng)能否兌現(xiàn)商業(yè)回報(bào)的核心變量。
曙光 8000 上線首周滿載是好消息,但并非所有智算中心都有這樣的需求支撐。根據(jù)工信部 7 月 20 日在國(guó)新辦新聞發(fā)布會(huì)上公布的數(shù)據(jù),截至今年 6 月底,全國(guó)智能算力規(guī)模達(dá) 2185EFLOPS,其中東部地區(qū)占比 55.9%,西部地區(qū)占 32.6%,中部地區(qū)僅占 10.6%。對(duì)此,一位長(zhǎng)期關(guān)注算力領(lǐng)域的投資人告訴記者,東部智算中心普遍處于高負(fù)荷運(yùn)行狀態(tài),而中西部部分智算中心建成后面臨客戶不足、利用率偏低的情況,算力越高端、密度越大,閑置的成本壓力也越大。
智算中心的電費(fèi)、運(yùn)維、帶寬、折舊等運(yùn)營(yíng)成本是剛性支出,集群規(guī)模越大每天的固定開(kāi)銷越高,利用率低于一定門(mén)檻就意味著持續(xù)虧損。尤其是對(duì)于剛剛轉(zhuǎn)型為算力運(yùn)營(yíng)商的企業(yè)來(lái)說(shuō),如何在建成之后持續(xù)找到足夠多的客戶、維持足夠高的利用率,是比技術(shù)更難回答的問(wèn)題。
國(guó)家超算互聯(lián)網(wǎng)正在嘗試緩解這種供需的地理錯(cuò)配。
7 月 13 日上線運(yùn)行的鄭州核心節(jié)點(diǎn)定位為全國(guó)算力的中央調(diào)度樞紐,用戶不管在哪個(gè)城市,接入平臺(tái)就能按需調(diào)用全國(guó)的算力資源。在采訪過(guò)程中,記者了解到,預(yù)計(jì) 2026 年底,國(guó)家超算互聯(lián)網(wǎng)年算力交易額就將突破 100 億元。另外,落地了中央調(diào)度樞紐的河南省也在省級(jí)層面建立了算力券機(jī)制,每年發(fā)放總額不超過(guò) 5000 萬(wàn)元,以降低中小企業(yè)的用算成本。
從需求端看,新的應(yīng)用場(chǎng)景也正在創(chuàng)造增量需求。
海光信息總裁助理兼智能計(jì)算產(chǎn)品部總經(jīng)理杜夏威在接受記者采訪時(shí)提到,AIAgent(智能體,能自主規(guī)劃和執(zhí)行復(fù)雜任務(wù)的 AI 系統(tǒng))的興起正在改變算力需求結(jié)構(gòu)。過(guò)去 AI 主要用 GPU 做模型推理,CPU 只起輔助調(diào)度作用,但 Agent 在執(zhí)行一個(gè)復(fù)雜任務(wù)時(shí),需要 CPU 完成任務(wù)編排、工具調(diào)用、緩存管理等大量工作,CPU 和 GPU 的算力配比正從過(guò)去的 1:8 向 1:1、甚至更高的方向變化。這意味著算力基礎(chǔ)設(shè)施的需求不是在減少,而是在變得更加多元。
中科曙光 AI 行業(yè)首席工程師李冉亦認(rèn)為,Agent 時(shí)代的負(fù)載是長(zhǎng)鏈路、高消耗的,要求計(jì)算、存儲(chǔ)、網(wǎng)絡(luò)、軟件整體協(xié)同,曙光的應(yīng)對(duì)方式是圍繞超節(jié)點(diǎn)打造全鏈路推理加速方案,從底層算子庫(kù)到上層模型部署做端到端的全鏈路優(yōu)化。
在他看來(lái),超節(jié)點(diǎn)正從 " 訓(xùn)練專用設(shè)施 " 向 " 訓(xùn)推一體的通用算力底座 " 演進(jìn),應(yīng)用場(chǎng)景已從大模型訓(xùn)練擴(kuò)展至推理、Agent、科學(xué)計(jì)算等更多領(lǐng)域。
工信部信息通信經(jīng)濟(jì)專家委員會(huì)委員盤(pán)和林對(duì)經(jīng)濟(jì)觀察報(bào)記者表示,超節(jié)點(diǎn)與傳統(tǒng) GPU 算力集群的本質(zhì)差異在于是否實(shí)現(xiàn)了內(nèi)存統(tǒng)一編址與垂直擴(kuò)展級(jí)互聯(lián)。傳統(tǒng) GPU 算力集群采用橫向擴(kuò)展,時(shí)延高、帶寬低,而超節(jié)點(diǎn)通過(guò)構(gòu)建統(tǒng)一內(nèi)存編址,時(shí)延可低至微秒級(jí),帶寬可達(dá)每秒 TB 級(jí)別,并可以直接訪問(wèn)跨節(jié)點(diǎn)資源。
" 簡(jiǎn)單來(lái)說(shuō),超節(jié)點(diǎn)彌補(bǔ)了國(guó)產(chǎn)算力單芯片性能不足的短板,使我們追平全球先進(jìn)算力水平成為可能。" 盤(pán)和林說(shuō)。
不過(guò),在盤(pán)和林看來(lái),國(guó)產(chǎn)超節(jié)點(diǎn)要真正大規(guī)模商用,還需要跨越兩個(gè)障礙。一是生態(tài)適配,目前各廠商的超節(jié)點(diǎn)之間存在不同的連接協(xié)議,如何統(tǒng)一這些協(xié)議以充分發(fā)揮互聯(lián)效率,同時(shí)針對(duì) DeepSeekV4、Qwen、GLM 等主流大模型完成適配并降低開(kāi)發(fā)者的適配門(mén)檻、避免重復(fù)開(kāi)發(fā),仍是行業(yè)需要解答的問(wèn)題;二是在提高系統(tǒng)可靠性的同時(shí)優(yōu)化成本,千卡乃至萬(wàn)卡同時(shí)接入超節(jié)點(diǎn)可能導(dǎo)致系統(tǒng)整體穩(wěn)定性下降,需要完善故障響應(yīng)和自愈等配套機(jī)制,而算力成本的下降則有賴于節(jié)點(diǎn)規(guī)?;蛦喂?jié)點(diǎn)成本的持續(xù)壓降,以此吸引更多 AI 大模型用戶接入超節(jié)點(diǎn)網(wǎng)絡(luò)。
國(guó)泰海通證券計(jì)算機(jī)首席分析師楊林告訴記者,算力競(jìng)爭(zhēng)的核心范式已從 " 單卡峰值 " 轉(zhuǎn)向 " 系統(tǒng)效率 ",價(jià)值分配正從 " 賣(mài)卡 " 向 " 賣(mài)系統(tǒng)、賣(mài)能力 " 全面遷移,光互連、液冷、網(wǎng)絡(luò)方案、系統(tǒng)集成與調(diào)度軟件等環(huán)節(jié)將獲得更高的價(jià)值權(quán)重。
根據(jù)華泰證券在相關(guān)研報(bào)中的測(cè)算,2028 年中國(guó)超節(jié)點(diǎn)架構(gòu)市場(chǎng)規(guī)模有望達(dá)到 3414 億元,2026 至 2028 年復(fù)合年均增長(zhǎng)率為 194%。