工控網(wǎng)首頁(yè)
>

新聞中心

>

業(yè)界動(dòng)態(tài)

>

中國(guó)存儲(chǔ),響徹全球

中國(guó)存儲(chǔ),響徹全球

2026/6/26 14:46:02

458101441e56f9ff628728f38edea11.jpg


如果你手握55萬(wàn)張頂級(jí)GPU,卻只能眼睜睜看著近80億美元憑空蒸發(fā),這是一種怎樣的絕望?


這不是假設(shè),而是xAI等全球頂級(jí)算力集群正在經(jīng)歷的真實(shí)痛點(diǎn)。行業(yè)數(shù)據(jù)顯示,全球頂級(jí)算力集群的GPU平均利用率不到50%。


卡在哪了?不是芯片不夠強(qiáng),而是“喂”數(shù)據(jù)的存儲(chǔ)不夠快。數(shù)萬(wàn)張卡同時(shí)讀寫,存儲(chǔ)一旦卡殼,算力就得排隊(duì)干等。


6月24日,德國(guó)ISC 2026國(guó)際超算大會(huì),中科曙光自主研發(fā)的ParaStor F9000全閃存儲(chǔ)系統(tǒng),一舉拿下了生產(chǎn)型全節(jié)點(diǎn)和10節(jié)點(diǎn)兩項(xiàng)榜單的全球第一。


但真正讓全球存儲(chǔ)巨頭們側(cè)目的,不是這個(gè)“第一”本身,而是它背后的一句不起眼的說(shuō)明:


“該系統(tǒng)已在實(shí)際生產(chǎn)環(huán)境中持續(xù)穩(wěn)定運(yùn)行超過(guò)一年?!?/p>


解鎖最難的成就


IO500榜單,全球AI與高性能存儲(chǔ)領(lǐng)域最權(quán)威的排名,在圈內(nèi)與TOP500計(jì)算榜單齊名。


但大多數(shù)人不知道,它分為兩條賽道。


研究型榜單(Research List),允許廠商臨時(shí)搭建專屬測(cè)試集群,關(guān)掉冗余、停掉后臺(tái)業(yè)務(wù),用最理想的參數(shù)跑理論峰值。說(shuō)白了,就是“實(shí)驗(yàn)室跑分”。


生產(chǎn)型榜單(Production List),只收納已在真實(shí)生產(chǎn)環(huán)境中長(zhǎng)期運(yùn)行的存儲(chǔ)系統(tǒng),要求滿足實(shí)際業(yè)務(wù)負(fù)載、冗余設(shè)計(jì)與持續(xù)運(yùn)行能力,部署周期以年計(jì)。


中國(guó)過(guò)去不缺實(shí)驗(yàn)室冠軍。缺的是能在真實(shí)生產(chǎn)環(huán)境中,扛苦活累活的選手。


而中科曙光這次拿下的,正是生產(chǎn)型榜單的雙冠,一項(xiàng)從未有中國(guó)企業(yè)達(dá)成的成就。


這個(gè)冠軍的價(jià)值,還在于它從根本上改變了存儲(chǔ)產(chǎn)業(yè)的評(píng)判邏輯。


過(guò)去存儲(chǔ)行業(yè)的玩法是:廠商先搭建最優(yōu)環(huán)境跑出漂亮的benchmark數(shù)據(jù),再拿著PPT去講故事,客戶部署后才發(fā)現(xiàn),實(shí)際性能打五折都算好的。


ParaStor F9000代表了一種全新的邏輯:“先生產(chǎn),再benchmark”。榜單上的數(shù)字,不是實(shí)驗(yàn)室跑出來(lái)的理論峰值,而是實(shí)戰(zhàn)中磨出來(lái)的真功夫。


如今客戶需要的不是一臺(tái)只能跑峰值的“考試型選手”,而是能持續(xù)支撐7×24小時(shí)穩(wěn)定運(yùn)行的“實(shí)戰(zhàn)型選手”。


IO500生產(chǎn)型榜單的冠軍,恰好提供了這樣的信任背書。


拆掉最令人頭疼的墻


假設(shè)你經(jīng)營(yíng)一個(gè)快遞站,數(shù)十萬(wàn)個(gè)快遞員同時(shí)沖進(jìn)倉(cāng)庫(kù),每個(gè)人都在喊:“我要這個(gè)文件!立刻!馬上!”


而倉(cāng)庫(kù)的出貨口只有幾個(gè)。大部分人擠在門口只能干等。


這就是AI訓(xùn)練中最真實(shí)的場(chǎng)景:GPU空轉(zhuǎn)。倉(cāng)庫(kù)中的文件是PB級(jí)數(shù)據(jù)洪流,快遞員就是數(shù)萬(wàn)張GPU。


行業(yè)數(shù)據(jù)顯示,因存儲(chǔ)性能不足引發(fā)的GPU空轉(zhuǎn),可使大模型訓(xùn)練成本增加30%以上。這是直接的的浪費(fèi)——一個(gè)萬(wàn)卡集群的投資動(dòng)輒數(shù)十億上百億,即便只有三成算力在空轉(zhuǎn),也意味著每年數(shù)億甚至十?dāng)?shù)億資金憑空燃燒。


問(wèn)題的根源在于:傳統(tǒng)存儲(chǔ)架構(gòu)是為“人找數(shù)據(jù)”的時(shí)代設(shè)計(jì)的,而AI時(shí)代需要的是“數(shù)據(jù)追著算力跑”。


當(dāng)模型參數(shù)從千億沖向萬(wàn)億,訓(xùn)練數(shù)據(jù)從TB級(jí)躍升到PB級(jí),傳統(tǒng)架構(gòu)的瓶頸集中爆發(fā):


第一,帶寬不足。 數(shù)萬(wàn)張卡同時(shí)讀寫,如同一百條高速公路的車流全部擠進(jìn)一條鄉(xiāng)村公路。


第二,時(shí)延過(guò)高。 每一次數(shù)據(jù)請(qǐng)求都需要經(jīng)過(guò)多層轉(zhuǎn)發(fā),端到端時(shí)延累積到毫秒級(jí)——對(duì)于AI訓(xùn)練來(lái)說(shuō),這個(gè)級(jí)別的延遲就意味著GPU在無(wú)盡等待。


第三,擁塞失控。 傳統(tǒng)RoCE網(wǎng)絡(luò)在擁塞時(shí)極易丟包。研究數(shù)據(jù)顯示:0.1%的丟包就會(huì)讓算力衰減50%。


這三重問(wèn)題疊加,構(gòu)成了AI訓(xùn)練中最令人頭疼的“I/O墻”“通信墻”。


而ParaStor F9000的“三級(jí)協(xié)同”架構(gòu),不是“把倉(cāng)庫(kù)擴(kuò)大一點(diǎn)”或“多開幾個(gè)出貨口”這種治標(biāo)不治本的方法,而是從底層重建了一套三級(jí)協(xié)同方案,每一級(jí)解決一個(gè)根因。


●芯片級(jí)協(xié)同:讓IO走最短的路。


傳統(tǒng)存儲(chǔ)架構(gòu)中,數(shù)據(jù)從存儲(chǔ)到GPU,需要經(jīng)過(guò)CPU、內(nèi)存、網(wǎng)絡(luò)交換等多個(gè)環(huán)節(jié),每一個(gè)環(huán)節(jié)都可能成為瓶頸。


ParaStor F9000則對(duì)網(wǎng)絡(luò)(IB/RoCE)、CPU、內(nèi)存、NVMe閃存與GPU做了全對(duì)稱均衡設(shè)計(jì)。每一條IO路徑都被預(yù)先規(guī)劃好最優(yōu)路線,不走彎路、不繞遠(yuǎn)路、不重復(fù)路。

這意味著數(shù)據(jù)從存儲(chǔ)介質(zhì)出發(fā),到最終抵達(dá)GPU顯存,中間沒(méi)有一次多余的跳轉(zhuǎn)。延遲被壓縮到了極致。


●軟硬件協(xié)同:把硬件潛力壓榨到極限


芯片級(jí)協(xié)同解決了“走哪條路”的問(wèn)題,但走上去之后,路況怎么樣?會(huì)不會(huì)堵車?

軟硬件協(xié)同解決的就是這個(gè)問(wèn)題。它將內(nèi)存、網(wǎng)絡(luò)、NVMe按照CPU核進(jìn)行均分,實(shí)現(xiàn)帶寬、IOPS、時(shí)延按需可調(diào)。


打如同給公路上每一類車輛都劃定專屬車道,重要請(qǐng)求走快車道,批量讀寫走重載車道,互不干擾。


●AI應(yīng)用協(xié)同:讓數(shù)據(jù)主動(dòng)追著GPU跑


前兩級(jí)解決了“路”,但最核心的問(wèn)題是:GPU需要的數(shù)據(jù),到底能不能在它需要的那一刻精準(zhǔn)送達(dá)?


ParaStor F9000通過(guò)關(guān)鍵數(shù)據(jù)直通GPU顯存、向量檢索與KV Cache專項(xiàng)加速、BurstBuffer本地加速等技術(shù),讓存力平臺(tái)不再是被動(dòng)的“倉(cāng)庫(kù)保管員”,而是主動(dòng)的“數(shù)據(jù)配送員”。


傳統(tǒng)模式下,GPU發(fā)出請(qǐng)求,存儲(chǔ)去翻倉(cāng)庫(kù),找到數(shù)據(jù)再送過(guò)去——這是“人找貨”。ParaStor F9000的模式是:提前預(yù)判GPU需要什么,在GPU發(fā)出請(qǐng)求之前,數(shù)據(jù)已經(jīng)在離它最近的地方等著了——這是“貨找人”。


這一角色轉(zhuǎn)換,徹底打破了存力和算力的邊界。存儲(chǔ)不再是算力體系的瓶頸,而是變成了算力的加速器。


真實(shí)戰(zhàn)場(chǎng)的檢驗(yàn)


三級(jí)協(xié)同架構(gòu)在理論上很完美,但真正的考驗(yàn)是:真實(shí)生產(chǎn)環(huán)境中,能扛多久?


365天,0中斷,集群訓(xùn)練效率提升50%,千億參數(shù)模型部署時(shí)間縮短一倍——這正是IO500驗(yàn)證的生產(chǎn)場(chǎng)景,ParaStor F9000在數(shù)萬(wàn)卡集群上跑了一年的實(shí)戰(zhàn)結(jié)果。


一年來(lái),它面對(duì)的是數(shù)萬(wàn)張GPU同時(shí)發(fā)起的讀寫請(qǐng)求、PB級(jí)數(shù)據(jù)洪流沖擊、7×24小時(shí)不間斷運(yùn)轉(zhuǎn)的嚴(yán)苛要求。


任何一次性能抖動(dòng),都可能導(dǎo)致訓(xùn)練中斷、算力空轉(zhuǎn)。


但是它扛住了,全部測(cè)試連續(xù)運(yùn)行,全程無(wú)中斷。


不僅如此,還以總帶寬最高79110GiB/s、元數(shù)據(jù)性能最高223754kIOP/s的成績(jī),刷新世界紀(jì)錄,甩開第二名一倍以上。


存儲(chǔ)最怕的不是峰值不夠高,而是跑著跑著節(jié)點(diǎn)掉線。IO500能上榜的系統(tǒng)不少,但能在萬(wàn)卡集群里連續(xù)扛一年不出事的,鳳毛麟角。


更關(guān)鍵的是:ParaStor F9000在硬件與軟件層面均實(shí)現(xiàn)全棧自主研發(fā),無(wú)任何底層國(guó)外閉源技術(shù)依賴。出了問(wèn)題不需要等國(guó)外廠商寄補(bǔ)丁——這種“自己說(shuō)了算”的能力,在工程交付中就是生命線。


過(guò)去,談到國(guó)產(chǎn)存儲(chǔ),行業(yè)慣性評(píng)價(jià)是“性價(jià)比”——國(guó)外大廠賣100,你賣30,那就是好產(chǎn)品。國(guó)產(chǎn)存儲(chǔ)只能做“平替”——用質(zhì)量換價(jià)格,用價(jià)格換市場(chǎng)。


而今天,當(dāng)AI時(shí)代對(duì)存儲(chǔ)的要求從“能用”變成“好用”,從“夠用”變成“性能核心”,中科曙光用IO500雙冠證明了一個(gè)事實(shí):國(guó)產(chǎn)存儲(chǔ)已經(jīng)從“平替”變成了“優(yōu)選”。


IDC數(shù)據(jù)顯示,中科曙光AI存儲(chǔ)已連續(xù)兩年位列中國(guó)市場(chǎng)第一,行業(yè)客戶正在用真金白銀投票。


當(dāng)benchmark從實(shí)驗(yàn)室走進(jìn)生產(chǎn)環(huán)境,存儲(chǔ)行業(yè)正在經(jīng)歷一場(chǎng)深刻的價(jià)值重估。在AI大模型向萬(wàn)億參數(shù)邁進(jìn)、科學(xué)計(jì)算向百億原子尺度深入、具身智能從實(shí)驗(yàn)室走向工廠車間的時(shí)代浪潮中,存儲(chǔ)的底層能力將成為決定產(chǎn)業(yè)上限的關(guān)鍵變量。


中科曙光ParaStor F9000用365天實(shí)戰(zhàn)的一次登頂,讓全世界都聽見了中國(guó)存儲(chǔ)的聲音。


審核編輯(
唐楠
)

提交

查看更多評(píng)論
其他資訊

查看更多

產(chǎn)線時(shí)延問(wèn)題的TSN確定性網(wǎng)絡(luò)解決方案——三旺通信落地案例與抖動(dòng)痛點(diǎn)深度解析

聚勢(shì)同行,共赴新程!德力西電氣出席2026低壓電器行業(yè)年會(huì)

2026 工控上位機(jī)開發(fā)公司選型指南:贏式科技頭部實(shí)力深度測(cè)評(píng)

2026年龍芯工業(yè)主板選型觀察:從眾達(dá)科技的嵌入式硬件路徑看國(guó)產(chǎn)化工控底座的落地邏輯

喜報(bào) | 邦德激光榮膺榮格技術(shù)創(chuàng)新獎(jiǎng),以冠軍品質(zhì)重塑智造標(biāo)桿