Zaprezentowany na targach ISC 2026 w Hamburgu, nowy moduł pamięci masowej DDN A1400X3M zapewnia 160 milionów IOPS na szafę i integruje oprogramowanie KV Cache oparte na technologii NVIDIA Dynamo, aby umożliwić dwuścieżkową akcelerację AI. Aktualizacja zapewnia także zwiększone bezpieczeństwo, obserwowalność i efektywność infrastruktury w przypadku wdrożeń sztucznej inteligencji na dużą skalę, eliminując typowe wąskie gardła potoku danych w procesach pozyskiwania, przygotowywania, szkolenia, wnioskowania, RAG i agentycznej sztucznej inteligencji.
Współzałożyciel i dyrektor generalny DDN, Alex Bouzari, podkreślił, że sukces współczesnej sztucznej inteligencji zależy od kompleksowej wydajności operacyjnej danych, a nie tylko od mocy obliczeniowej. Najnowsze innowacje DDN maksymalizują wykorzystanie procesora graficznego, obniżają koszty wnioskowania, przyspieszają generowanie tokenów i poprawiają ogólną ekonomikę dużych fabryk sztucznej inteligencji.
Aktualizacja sprzętu A1400X3M
Będąc następcą A1400X2, nowy A1400X3M obsługuje oprogramowanie EXAScaler Luster firmy DDN. Obudowa 2RU z 24 dyskami SSD umożliwia modernizację procesorów Intel Ice Lake, procesorów AMD Genoa i interfejsów PCIe Gen4 do interfejsów PCIe Gen5 o podwójnej prędkości. Zapewnia przepustowość odczytu do 190 GB/s i zapisu sekwencyjnego do 110 GB/s, co oznacza poprawę wydajności odczytu o 35% w porównaniu z poprzednią generacją. Wdrożenie w pełnej szafie pozwala uzyskać 160 milionów IOPS, co odpowiada około 4 milionom IOPS na obudowę.
Przyspieszenie pamięci podręcznej KV zintegrowane z NVIDIA Dynamo
Pamięć podręczna KV przechowuje klucze i wartości aktywacji LLM podczas wnioskowania, aby wyeliminować zbędne przeliczanie i zwiększyć wydajność. Struktura wnioskowania rozproszonego Dynamo firmy NVIDIA rozszerza pamięć podręczną GPU KV na pamięć masową NVMe poprzez czterowarstwową hierarchię pamięci (HBM, DRAM, lokalny dysk SSD, zewnętrzny NVMe), przekształcając pamięć podręczną rezydującą w pamięci masowej w trwałą, adresowalną pamięć kontekstową. Jako wykwalifikowany partner NVIDIA NVMe, DDN integruje tę możliwość w swoim równoległym systemie plików EXAScaler i platformach obiektowej pamięci masowej Infinia.
Dwuplatformowa infrastruktura AI firmy DDN zaspokaja różne potrzeby w zakresie obciążenia pracą: Infinia zapewnia wydajność metadanych o bardzo małych opóźnieniach i wysoką współbieżność na potrzeby zadań wnioskowania i pobierania, podczas gdy EXAScaler zapewnia wiodącą prędkość równoległego systemu plików na potrzeby szkolenia AI i punktów kontrolnych. Łącznie ujednolicają kompleksowe przepływy pracy z danymi AI, eliminują silosy, utrzymują wysokie wykorzystanie procesora graficznego i skracają czas do pierwszego tokena.
Zoptymalizowana platforma KV Cache zapewnia kluczowe zalety: rozproszone współdzielone buforowanie do wnioskowania na dużą skalę, dostęp o bardzo małych opóźnieniach do zadań AI o długim kontekście, natywna obsługa agentycznej sztucznej inteligencji, RAG i potoków wnioskowania wieloetapowego, głęboka kompatybilność z Dynamo i vLLM, do 55 razy szybsze ładowanie pamięci podręcznej, wyższa wydajność procesora graficznego i obniżone koszty operacyjne na token.
Ulepszenia bezpieczeństwa i wydajności
DDN wprowadziło ulepszone funkcje klasy korporacyjnej dla produkcyjnych środowisk AI. Aktualizacje zabezpieczeń obejmują obsługę wielu dzierżawców na platformie bare-metal, zarządzanie kluczami szyfrowania zgodnymi z KMIP i widoczność operacyjną włączoną przez VictoriaLogs, a także CSI dla wielu dzierżawców i standardowe interfejsy API. Ulepszenia wydajności obejmują inteligentne przypinanie plików i akcelerowane przez NAND Hot Pools, które dzielą dane z drogich nośników typu all-flash na ekonomiczne dyski twarde.
Wdrożenia w świecie rzeczywistym potwierdzają wzrost wydajności: Salesforce wykorzystał Google Cloud Managed Lustre (obsługiwany przez EXAScaler), aby osiągnąć 1,5 razy szybsze szkolenie modeli, 75% mniejsze opóźnienia we/wy i 42% mniejsze wydatki na szkolenia. A1400X3M osiągnie ogólną dostępność pod koniec trzeciego kwartału 2026 r., a pełne arkusze danych będą publicznie dostępne.
Pekin Qianxing Jietong Technology Co., Ltd.
Sandy Yang/dyrektor ds. strategii globalnej
WhatsApp / WeChat: +86 13426366826
E-mail: yangyd@qianxingdata.com
Strona internetowa: www.qianxingdata.com/www.storageserver.com
Koncentracja biznesowa:
Dystrybucja produktów ICT/Integracja systemów i usługi/Rozwiązania infrastrukturalne
Dzięki ponad 20-letniemu doświadczeniu w dystrybucji IT współpracujemy z wiodącymi światowymi markami, aby dostarczać niezawodne produkty i profesjonalne usługi.
„Wykorzystanie technologii do budowy inteligentnego świata”Twój zaufany dostawca usług produktów ICT!