
Huawei predstavuje OceanStor M900 Context Memory Storage na urýchlenie inferencie AI v hyperscale dátových centrách
ŠANGHAJ, 17. september 2026 /PRNewswire/ – David Wang, podpredseda predstavenstva a rotujúci predseda predstavenstva spoločnosti Huawei, vo svojom prejave na konferencii HUAWEI CONNECT 2026 oficiálne predstavil úložisko OceanStor M900 Context Memory Storage. Produkt je navrhnutý pre inferenciu AI v hyperscale dátových centrách a poskytuje systémom SuperPoD plne zdieľaný pamäťový priestor, ktorý ponúka kapacitu v rozsahu PB a výkon na úrovni TB/s. To prináša posun do infraštruktúry AI od modelu zameraného na výpočty k hlbokej spolupráci medzi výpočtami, sieťou a úložiskom. Pokrok pomôže uvoľniť výpočtový výkon systémov SuperPoD.
Rok 2026 priniesol zrýchlený prechod AI od technologických prielomov k rozsiahlej implementácii. Aplikácie AI sa vyvinuli z chatbotov na agentov schopných autonómne vykonávať zložité úlohy. Títo agenti sa široko využívajú v kritických sektoroch, čo znamená začiatok éry agentskej AI.
Keďže veľké modely narastajú až do parametrov v mierke 10 biliónov, systémy SuperPoD sa stávajú optimálnou voľbou pre infraštruktúru AI. Bežné veľké modely už podporujú kontextové okná presahujúce jeden milión tokenov, viacstupňová inferencia a zložité úlohy sa stali normou a dáta vyrovnávacej pamäte KV generované počas inferencie neustále rastú. Tieto trendy posunuli pamäť na čipe a DRAM za hranice ich možností, z hľadiska kapacity aj nákladovej efektívnosti. Odvetvie sa zhoduje na potrebe budovania viacvrstvového úložného systému, ktorý koordinuje pamäť na čipe, DRAM a SSD disky, aby sa vytvoril plne zdieľaný pamäťový priestor s obrovskou kapacitou.
Spoločnosť Huawei predstavila úložisko OceanStor M900 Context Memory Storage, ktorá prekonáva problematické miesta v kapacite pamäte pri ultradlhých kontextoch a viacnásobnej inferencii. OceanStor M900 pomocou siete UnifiedBus budovuje globálnu viacvrstvovú KV vyrovnávaciu pamäť v mierke PB s pripojeniami na jeden skok. Tým sa plne uvoľňuje výpočtový potenciál systému SuperPoD a zrýchľuje inferencia AI v hyperscale dátových centrách. Úložisko OceanStor M900 Context Memory Storage má tri kľúčové schopnosti:
Prekonávanie hraníc kapacity a podpora AI vo veľkom meradle pomocou obrovskej pamäte
Vďaka vysokorýchlostnej prepojovacej sieti UnifiedBus dosahuje vyrovnávacia pamäť KV globálne združovanie a zdieľanie s viacvrstvovým úložiskom. Vyrovnávacia pamäť KV systémov SuperPoD sa rozširuje z pamäte na čipe a DRAM na disky SSD, čo umožňuje jednému klastru poskytnúť kapacitu 64 PB. Dostupná kapacita vyrovnávacej pamäte KV na NPU sa zvýšila z gigabajtov na terabajty, čo umožňuje ukladanie, zdieľanie a opätovné použitie väčšieho množstva kontextu. Tým sa výrazne zvyšuje úspešnosť zásahov do vyrovnávacej pamäte KV.
Zvýšenie výkonu inferencie a plné uvoľnenie výpočtového výkonu
OceanStor M900 je prvá architektúra v odvetví, ktorá integruje CPU, sieťovú riadiacu jednotku a riadiacu jednotku NAND. Poskytuje natívnu sémantiku KV, ktorá umožňuje pripojenie z NPU SuperPoD k SSD na jeden skok. Vďaka tomu zaniká potreba konverzie protokolov a presmerovania CPU, čím sa znižuje latencia prístupu z milisekúnd na 60 mikrosekúnd, teda o 90 %. Jediný klaster poskytuje súhrnnú šírku pásma prístupu 40 TB/s, čo je 1,5-krát viac oproti konkurenčným riešeniam. V typických scenároch programovania s AI táto architektúra zdvojnásobuje priepustnosť tokenov inferenčného klastra a skracuje čas do prvého tokenu na polovicu, čím prevádza výpočtový výkon na produktivitu.
Zníženie nákladov na tokeny umožní ekonomické nasadenie AI vo veľkom meradle
OceanStor M900 využíva prvú adaptívnu technológiu úložiska s podporou KV, ktorá na základe hodnoty dát predpovedá životné cykly vyrovnávacej pamäte KV a inteligentne distribuuje dáta medzi úložnými médiami. Táto technológia umožňuje až 24 zápisov na disk za deň (DWPD), čím 16-násobne predlžuje výdrž SSD disku a zaisťuje stabilitu po dobu troch rokov. Znížením nákladov na výmenu médií, ako aj prevádzku a údržbu, sa znižujú dlhodobé náklady na rozsiahlu inferenčnú infraštruktúru AI a umožňuje sa jej rýchlejšie nasadenie.
S rozširovaním AI do hlavných výrobných systémov vo všetkých druhoch odvetví sa infraštruktúra AI vyvíja z modelu zameraného na výpočty smerom k užšej spolupráci medzi výpočtami, sieťou a úložiskom. Ukladanie kontextovej pamäte bude nevyhnutné pre neustále zvyšovanie kapacity a efektívnosti prístupu k hyperscale inferenčným vyrovnávacím pamätiam KV.
Share this article