WEKA wprowadziła macierz all-flash WEKAPod o skali eksabajtowej, zoptymalizowaną pod kątem oprogramowania NeuralMesh szóstej generacji. Nowa platforma zapewnia ogromną przepustowość danych do obsługi produkcyjnych obciążeń szkoleniowych i wnioskowania AI. Pozycjonuje WEKA obok producentów pamięci masowych AI premium, takich jak DDN, Everpure, NetApp i VAST Data, oferując wiodącą w branży gęstość 1,1 eksabajta efektywnej pojemności w pojedynczej szafie rack 56 RU.

NeuralMesh v6 integruje natywną wielodostępność na skalę hiperskalowalną, ujednolicony stos plików i obiektów S3 oparty na NVMe, inteligentną mobilność danych z replikacją i zdalnym buforowaniem, gwarantowaną wydajność stałej redukcji danych, przepływy pracy natywne dla Kubernetes oraz ujednoliconą obserwację. Na sprzęcie Oracle Cloud Infrastructure (OCI) H100, jego Augmented Memory Grid zapewnia 10-krotnie wyższą przepustowość tokenów, 10-krotnie więcej jednoczesnych użytkowników i 7-krotnie wyższą produkcję tokenów na GPU niż NVIDIA CMX w produkcji. Wdrożenia CoreWeave zwiększają przepustowość tokenów na GPU o 4,2x i skracają opóźnienie TTFT nawet o 6x w porównaniu do CMX.
Współzałożyciel i dyrektor generalny WEKA, Liran Zvibel, skomentował w lipcu 2026 r.: „Starsza infrastruktura AI zbudowana dla tradycyjnych obciążeń nie jest w stanie sprostać nowoczesnym operacjom ery wnioskowania. Dzisiejsza rentowność AI zależy od efektywności przestrzeni w szafie rack, zużycia energii, stabilności łańcucha dostaw i gęstości operacyjnej.
„WEKAPod jest specjalnie zaprojektowany, aby sprostać tym ograniczeniom. Zaprojektowany wyłącznie dla obliczeń ery wnioskowania z samokontrolowanym łańcuchem dostaw, zapewnia przewagę kosztową i lepszy TCO w zakresie potrzeb infrastruktury AI pełnego stosu, ustanawiając nowy punkt odniesienia dla oceny wielkoskalowej produkcyjnej infrastruktury AI.”
WEKAPod to dedykowane urządzenie pamięci masowej, które dostarcza dane do klastrów GPU, takich jak NVIDIA SuperPODs, integrując wstępnie skonfigurowany sprzęt i oprogramowanie platformy danych WEKA. Pierwsza wersja, wprowadzona pod koniec 2025 r. z modelami PCIe Gen4 Prime i Gen5 Nitro z warstwowymi dyskami SSD AlloyFlash, zaktualizowana trzecia generacja obejmuje modele Nitro, Prime i nowe konfiguracje Prime Max oparte na 2RU, dostosowane do produkcyjnego wnioskowania AI.
Prime Max to model WEKA o najwyższej pojemności, przekraczający 1 EB na szafę rack. Prime zapewnia zrównoważoną cenę i wydajność dzięki czterem serwerom rack 2U z 70 mieszanymi dyskami NVMe QLC/TLC zarządzanymi przez AlloyFlash. Nitro jest przeznaczony dla wydajnych fabryk AI i środowisk GPU-as-a-service z setkami do tysięcy aktywnych GPU.
Trzecia generacja WEKAPod to pierwszy w branży system w jednej szafie rack, który przekroczył skalę eksabajtową efektywnej pojemności. Zawiera 441,5 PB surowej pamięci masowej NVMe, zapewniając 1,1 EB efektywnej pojemności dzięki redukcji danych NeuralMesh, a także przepustowość 10,2 TB/s na szafę rack i 210 milionów IOPS na poziomie szafy rack.
Jego zmodernizowany stos sprzętowy obejmuje wewnętrzną magistralę PCIe Gen6, połączenia dysków oparte na kablach bez płyty tylnej, karty NVIDIA ConnectX SuperNIC z łącznością Ethernet Spectrum-X oraz zarządzanie termiczne zdefiniowane programowo. Platforma minimalizuje ślad centrum danych, optymalizuje wykorzystanie przestrzeni w szafie rack i poprawia efektywność tokenów na wat bez kompromisów w zakresie przepustowości lub wydajności obciążeń. WEKA twierdzi, że przewyższa konkurencyjne rozwiązania o 267% pod względem gęstości efektywnej pojemności i o 114% pod względem gęstości przepustowości na jednostkę szafy rack.
Bezpośrednio zarządzając pozyskiwaniem komponentów bez polegania na kanałach OEM, WEKA zapewnia dostawcom chmur AI i przedsiębiorstwom stabilne ceny i przewidywalne czasy realizacji dla wielkoskalowych wdrożeń infrastruktury. Wszystkie jednostki WEKAPod są dostarczane fabrycznie skonfigurowane i wstępnie zweryfikowane z pełnymi możliwościami NeuralMesh v6, w tym Augmented Memory Grid, eliminując potrzebę dedykowanych zespołów ds. pamięci masowej na miejscu.
NeuralMesh v6, system plików WEKA, wykorzystuje Augmented Memory Grid do rozszerzenia pamięci GPU dla obciążeń wnioskowania. Zewnętrznie udostępnia pamięć masową jako bufor KV o niskim opóźnieniu (poziom mikrosekund) i przepustowości wieloterabajtowej na sekundę, zapewniając przestrzeń adresową o skali petabajtowej dla modeli AI.
Kluczowe możliwości NeuralMesh 6 obejmują:
Composable Clusters: Zapewnia pełną izolację sprzętową z dedykowanym procesorem, pamięcią i pamięcią masową dla głównych najemców, zapewniając gwarantowane przydzielanie zasobów, ścisłe rozdzielenie obciążeń i spójną wydajność przy dużych obciążeniach.
Virtual Multi-Tenancy: Oferuje izolację klasy VPC za pośrednictwem Virtualized RDMA Data Fabric (VRDF), obsługując prywatne sieci VLAN, nakładające się przestrzenie IP, QoS na najemcę, niezależne szyfrowanie KMS i uwierzytelnianie LDAP/AD. Skaluje się do ponad 1000 izolowanych logicznych najemców na klaster, z nowym udostępnianiem najemców poniżej 30 minut.
Współdzielone fizyczne dyski NVMe w wielu klastrach NeuralMesh maksymalizują równoległość urządzeń dla wnioskowania wielodostępnego. Pojedynczy klaster sprzętowy obsługujący 50 klastrów Composable Clusters może pomieścić do 50 000 izolowanych logicznych najemców. Ujednolica dostęp do plików S3 i POSIX w jednej przestrzeni nazw, umożliwiając transfery danych S3-over-RDMA bez kopiowania bezpośrednio do pamięci GPU z 2000–5000 jednoczesnymi połączeniami węzłów — około pięciokrotnie większą niż konwencjonalna współbieżność S3.
Jego technologia AlloyFlash przejrzyście łączy ekonomiczne dyski NVMe QLC i wysokowydajne dyski NVMe TLC w jednym klastrze, kierując obciążenia wrażliwe na opóźnienia do TLC, a zadania związane z dużą pojemnością do QLC przy koszcie o 30–40% niższym za TB.
Stała redukcja danych łączy fingerprinting, haszowanie podobieństwa, deduplikację i kompresję z narzutem zapisu poniżej 5%, zapewniając oszczędność pojemności do 6x dla danych szkoleniowych AI. WEKA zapewnia gwarancje umowne zarówno dotyczące współczynników redukcji, jak i wpływu na wydajność, z analizą obciążeń przed sprzedażą w celu prognozowania efektywności w rzeczywistych warunkach.
Wszystkie procesy redukcji danych działają poza krytyczną ścieżką zapisu poprzez kompresję podobieństwa w tle i deduplikację między systemami plików, umożliwiając zapisy z prędkością natywnego NVMe niezależnie od wykorzystania pojemności lub obciążenia w tle. Pozwala to uniknąć degradacji wydajności zapisu, powszechnej w architekturach redukcji w linii podczas intensywnego szkolenia AI z częstymi punktami kontrolnymi, odzwierciedlając projekt strefy lądowania ExaGrid bez deduplikacji dla spójnej wydajności.
NeuralMesh v6 obsługuje pełne możliwości federacji i globalnej przestrzeni nazw. Jego asynchroniczna replikacja umożliwia mobilność danych AI, cloudbursting i współpracę między wieloma lokalizacjami, z priorytetową replikacją metadanych do natychmiastowego przeglądania środowiska docelowego i nawadniania danych na żądanie. Zmniejsza to zużycie przepustowości sieci WAN dzięki replikowanym skompresowanym danym.
Dedykowany operator Kubernetes automatyzuje wdrażanie klastrów i zarządzanie cyklem życia dla chmur AI i laboratoriów badawczych opartych na Kubernetes. Ujednolicona platforma obserwacji oparta na SaaS zapewnia pulpity nawigacyjne dla wielu klastrów, diagnostykę na poziomie klienta, konfigurowalne inteligentne alerty i zintegrowane przekierowanie do Slack, PagerDuty lub poczty e-mail z bezpośrednimi linkami do pulpitów nawigacyjnych.
Dyrektor ds. Produktów WEKA, Ajay Singh, stwierdził: „Dzisiejsi operatorzy produkcyjnego AI polegają na rozproszonych, dostosowanych stosach stron trzecich z rozproszonymi warstwami plików/obiektów, ręcznym przenoszeniem danych i dodaną wielodostępnością. NeuralMesh 6 rozwiązuje te problemy dzięki ujednoliconej platformie, która łączy wysokowydajne pliki i pamięć obiektową o dużej pojemności na współdzielonym sprzęcie, z natywną wielodostępnością, inteligentną mobilnością danych i wbudowaną efektywnością danych. Jest specjalnie zaprojektowany do produkcyjnych obciążeń wnioskowania, a nie do nich dostosowany.”
NeuralMesh 6 będzie dostępny w ogólnej dostępności w H2 2026, z bezpłatnymi, płynnymi aktualizacjami dostępnymi dla wszystkich obecnych klientów WEKA za pośrednictwem standardowych kanałów aktualizacji.
Beijing Qianxing Jietong Technology Co., Ltd.
Sandy Yang/Dyrektor ds. Strategii Globalnej
WhatsApp / WeChat: +86 13426366826
E-mail: yangyd@qianxingdata.com
Strona internetowa: www.qianxingdata.com/www.storagesserver.com
Fokus biznesowy:
Dystrybucja produktów ICT/Integracja systemów i usługi/Rozwiązania infrastrukturalne
Z ponad 20-letnim doświadczeniem w dystrybucji IT, współpracujemy z wiodącymi globalnymi markami, dostarczając niezawodne produkty i profesjonalne usługi.
„Wykorzystując technologię do budowania inteligentnego świata” Twój zaufany dostawca usług produktowych ICT!