SK Hynix wspierało Etched, amerykański startup zajmujący się inferencją AI, budujący systemy w skali rack z zastrzeżonymi technologiami Low Voltage Inference (LVI) i Cluster Scale Memory (CSM).
Etched rozwiązuje krytyczny wąski gardło w branży: tradycyjne procesory graficzne oferują nadmiar mocy obliczeniowej, ale niewystarczającą pamięć do dużej skali wnioskowania AI, co prowadzi do kłopotliwych wielowarstwowych ram pamięci podręcznej KV.Jego dopasowane układy wnioskowe zmniejszają zużycie energii i przewyższają konwencjonalne GPU HBM w zakresie przepustowości i pojemności pamięci, zmniejszając opóźnienie związane z pamięcią podręczną KV i złożoność projektu.
Ta inwestycja nastąpiła po tym, jak izraelskie startup Majestic Labs opuściło tryb ukrycia, a firma buduje również serwery inferencyjne z niestandardowymi procesorami z dużymi zbiornikami pamięci.
Założona w 2023 roku w San Jose przez trzech studentów Harvardu, którzy opuścili studia, główny zespół Etched to dyrektor generalny Gavin Uberti, prezes Robert Wachen i Chris Zhu.000 Thiel Fellowship, aby pobudzić jego wczesny rozwój.
Zespół zbudował niestandardowe przetwarzanie wstępnego napełnienia LVI i współdzieloną pamięć CSM w celu zwiększenia wydajności wnioskowania.umożliwia rozwój komercyjnych wniosków na dużą skalę.
Zhu zauważył, że główne chipy sztucznej inteligencji cierpią na silne osłabienie termiczne pod dużym obciążeniem: zwiększone zużycie energii obniża prędkość zegara,obniżenie rzeczywistej przepustowości wnioskowania o połowę poniżej teoretycznego szczytuChipy Etched's uruchamiają jednostki arytmetyczne przy połowie napięcia typowego dla przemysłu, znacząco zwiększając gęstość obliczeń.
Zwrócił również uwagę na kluczowe kompromisy sprzętowe: układy sztucznej inteligencji wyposażone w HBM pozostają w tyle za SRAM w zakresie prędkości dekodowania ze względu na ograniczenia pamięci i połączeń,podczas gdy czyste chipy SRAM kompromitują gęstość obliczeń i zdolność do szybszego dostępu, zmniejszając ogólną przepustowość.
To utrudnia działanie dużych modeli MoE, ponieważ transmisja tokenów między warstwami w wielu warstwach pamięci zwiększa opóźnienie.
Architektura CSM Etched® tworzy zunifikowaną, współdzieloną pamięć o niskim opóźnieniu dla skalowalnego sprzętu, wykorzystując własne szybkie połączenia, aby przyspieszyć dostęp do pamięci cross-chip.
Jego hybrydowa konstrukcja HBM/SRAM zrównoważy pojemność pamięci i opóźnienie między układami, zapewniając interaktywne wnioski o wysokiej przepustowości.wady termiczne i funkcjonalne czystej SRAM, 3D DRAM i rozwiązania na chipach optycznych.
Ta innowacja oddziela stosy HBM od ograniczeń architektonicznych GPU, konsolidować rozproszone zasoby pamięci i zapewnia prędkość dostępu na poziomie SRAM za pomocą zaawansowanej technologii połączeń.
System stojaków Etched'a posiada układ o wysokim poziomie połączeń między sobą, z 16 dedykowanymi kablami łączącymi tylne porty z ośmioma podstawowymi jednostkami sprzętowymi.
System obsługuje główne modele LLM, modele MoE i architektury beztransformatorów, takie jak Mamba, a firma koncentruje się na badań i rozwoju całego systemu oraz sprzedaży komercyjnej.
Historia finansowania
2022 Zakłada się spółkę
2023 r. $5,4 mln.
Do 2024 roku 120 milionów dolarów serii A.
2025 500 milionów dolarów serii B
2026
Całkowite finansowanie do tej pory: $925.4M
Sequoia Capital prowadziła rundę C z 2026 roku, z udziałem Andreessen Horowitz, Jane Street i SK Hynix..
Jego konsekwentny roczny tempo pozyskiwania funduszy odzwierciedla ciągłą iterację produktów, wspieraną przez silny popyt klientów i solidne zaufanie inwestorów.
Firma otworzyła fabrykę o mocy 10 MW w Milpitas, aby zwiększyć wydajność prototypowania i produkcji.
Główny architekt Saptadeep Pal ujawnił, że Etched ma ponad 400 pracowników z zarezerwowanymi zamówieniami klientów przekraczającymi miliard dolarów.optymalizacja współpracy z dostawcami i testowania produktów w celu wspierania szybkiego skalowania.
Jej główni klienci obejmują duże przedsiębiorstwa, nowo powstające dostawców chmury i globalnych hyperscalerów oferujących rozwiązania inferencji jako usługi.
Komentarz
Jeśli Etched i Majestic Labs' nowe stoiska wnioskowe wykroczą poza tradycyjną pamięć podręczną KV, przekształcą rynek pamięci masowej dla przedsiębiorstw.tworzenie możliwości współpracy dla dostawców takich jak Dell, HPE, NetApp i VAST Data do sparowania szeregów pamięci masowej z serwerami inferencji nowej generacji dla optymalnej wydajności.
Pekin Qianxing Jietong Technology Co., Ltd.
Sandy Yang, dyrektor ds. strategii globalnej
WhatsApp / WeChat: +86 13426366826
Email: yangyd@qianxingdata.com
Strona internetowa: www.qianxingdata.com/www.storagesserver.com
Skoncentruj się na biznesie:
Dystrybucja produktów ICT/Integracja systemów i usługi/Rozwiązania infrastrukturalne
Dzięki ponad 20-letniemu doświadczeniu w dystrybucji IT współpracujemy z wiodącymi światowymi markami w celu dostarczania niezawodnych produktów i profesjonalnych usług.
Używanie technologii do budowy inteligentnego świata•Twój zaufany dostawca usług produktów ICT!