Zilliz wprowadził Milvus v3.0, otwartą bazę danych wektorowych, dodając dostęp do danych pochodzących z jezior i ulepszoną silnik wyszukiwania dla producentów sztucznej inteligencji.
Architektura Lake-native przechowuje surowe dane w otwartych formatach w chmurze, zamiast kopiować je w samodzielnych bazach danych.Zilliz zaprezentował swój koncept Vector Lakebase w czerwcowym publicznym zapowiedziDyrektor generalny Charles Xie opisał go jako zunifikowaną bazę danych umożliwiającą zapytania w czasie rzeczywistym, eksplorację danych i wielopetabytowe szkoleń AI bez kopii danych,zestawy migracji lub równoległego przechowywaniaPoziom jednolitego przechowywania obiektów obsługuje zarówno wyszukiwanie wektorowe w sieci o niskim opóźnieniu, jak i analizę na dużą skalę identycznych plików źródłowych.
Współzałożyciel i dyrektor technologiczny Zilliz James Luan skomentował: "Milvus 3.0 uruchamia odzyskiwanie produkcji bezpośrednio nad istniejącymi magazynami danych i dostarcza bardziej wydajny silnik dla nowoczesnych obciążeń pracą AI.To samo rdzeń napędza bazę Zilliz Vector Lakebase., zwiększone elastycznym skalowaniem, uproszczonymi operacjami i narzędziami na poziomie przedsiębiorstwa do zarządzania danymi sztucznej inteligencji na dużą skalę.
Bazy danych wektorowe przechowują wbudowane wektory numeryczne dla tekstu, obrazów i innych treści w celu wyszukiwania podobieństwa.przyjęte przez ponad 10, 000 firm dla RAG, silników rekomendacji i agentów AI, z ponad 100 milionami zarejestrowanych wyciągnięć Docker.
Tradycyjne systemy sztucznej inteligencji utrzymują oddzielne kopie danych do pobierania w czasie rzeczywistym i analizy offline, co wiąże się z dodatkowymi kosztami przechowywania, długotrwałymi eksportami danych,rurociągi synchronizacyjne i duże koszty operacyjne.
Zdolności Milvus 3.0
1Zbiory zewnętrzneSystem tworzy indeksy wektorowe, pełnetekstowe, JSON i skalarne na danych źródłowych bez duplikacji,ekspozycja ich za pośrednictwem standardowych native API. Inkrementalna synchronizacja automatycznie aktualizuje indeksy w miarę zmiany danych jeziora.
2- Silnik magazynowy.: Nowy, oparty na manifestech silnik do odczytu odczytu wzmacniania do wyszukiwania obiektów z niskim opóźnieniem, wykorzystujący otwarty, kompatybilny ze Strzałką wir jako domyślny format kolumn.
3.Snapshots w czasie.: Lekkie, tylko do odczytu zdjęcia zbiorów umożliwiają wykonywanie zadań deduplikacji, oceny i walidacji w trybie offline na stabilnych zestawach danych bez zakłócania produkcji zapisów.
4.Przewoźnicy złącza iskry i serii: Konektor Spark DataSource V2 integruje Milvus z procesami Spark, Databricks i EMR, a także z natywnymi funkcjami wektorów do deduplikacji i klastrowania.

Standardowe wyszukiwanie wektorowe Top-K odbiera tylko najbardziej podobne wektory przez obliczenia odległości, cierpiąc na słabe skalowanie z wysoką liczbą wektorów i wymiarami.0 rozszerza wyszukiwanie daleko poza podstawowe wyszukiwanie najbliższego sąsiada:
1Sortowanie po stronie serwera, agregacja i wyszukiwanie facetów łączą podobieństwo semantyczne z filtrami metadanych (czasoznacznik, cena, kategoria, najemca itp.), eliminując przetwarzanie późniejsze po stronie klienta.
2.StructList wielowektorowe wyszukiwanie obsługuje podmioty z wieloma osadzeniami (części dokumentów, łaty obrazów, multimodalne dane produktu) i działa z modelem późnej interakcji, takim jak ColBERT i ColPali.
3.Optymalizowany indeks rzadkości zmniejsza ilość danych przechowywanych o ~ 70% przy jednoczesnym dopasowaniu oryginalnej wydajności odwołania, w połączeniu z wyuczonymi wektorami rzadkości SINDI, wbudowanym MinHash, niemożliwymi do wyłączenia polach wektorowych,niestandardowe słowniki pełnego tekstu i kompatybilność z szerszym indeksem Faiss.
Luan dodał, że obciążenia produkcyjne sztucznej inteligencji wymagają rankingu, grupowania i wyszukiwania wielowektorowego w bazie danych i w3.0 przekształcone pamięci masowe w celu zapewnienia szybkiego dostępu do pamięci masowej obiektów wraz z bogatszym przetwarzaniem w silniku.
Zjednoczony rdzeń napędza zarówno samodzielnie hostowany Milvus open source, jak i w pełni zarządzany Zilliz Cloud.,analityka serii, jednolite indeksowanie, zarządzanie przedsiębiorstwem i automatyzacja na jednym źródle danych sztucznej inteligencji.
Przemysł Kontext konkurencyjny
Aktualizacja zwiększa presję na rywali Pinecone, Qdrant i Weaviate, którzy ścigają się o zmniejszenie opóźnienia wyszukiwania: Qdrant uruchomił szybsze indeksowanie, klastry o wysokiej dostępności i dzienniki audytu zgodności w kwietniu;Pinecone uruchomiło w maju przedwyliczone zestawy wektorów i komponowalne odzyskiwarki w celu przyspieszenia przepływów pracy agentów.
Sprzedawcy bazy danych wektorowych konkurują z wielomodelowymi platformami, takimi jak Regatta, SingleStore i SurrealDB.głębsze partnerstwa między bazami danych stoją w obliczu barier architektonicznych i silników magazynowaniaNa rynku gracze wektorowi mogą z czasem dodawać natywne wsparcie dla struktury, wykresu, dokumentu lub szeregu czasowego.
Dostępność
Milvus 3.0 pozostaje projektem LF AI & Data pod licencją Apache 2.0, wdrażalnym za pośrednictwem Docker lub Kubernetes, w tym środowisk air-gapped, z kompatybilnością dla S3,Przechowywanie obiektów GCS i Azure Blob. Początkowe zakres SDK obejmuje Python, Go i Node.js, przy wsparciu dla Java.wraz z godzinami pracy w biurze społeczności dla wsparcia deweloperów.
Zarządzana chmura Zilliz wbudowała Milvus 3.0 jako podstawową warstwę indeksowania, dodając elastyczność przedsiębiorstwa, bezpieczeństwo i zunifikowane operacje w jednej kopii udostępnianych danych.
Wskazówka
Zbiory zewnętrzne wdrażają indeksowanie jeziora zero-kopii bez migracji danych; Loon rozwiązuje wąski gardło wzmacniania odczytu, które wcześniej ograniczało przechowywanie obiektów dla zapytań wektorowych o niskim opóźnieniu.
Pekin Qianxing Jietong Technology Co., Ltd.
Sandy Yang, dyrektor ds. strategii globalnej
WhatsApp / WeChat: +86 13426366826
Email: yangyd@qianxingdata.com
Strona internetowa: www.qianxingdata.com/www.storagesserver.com
Skoncentruj się na biznesie:
Dystrybucja produktów ICT/Integracja systemów i usługi/Rozwiązania infrastrukturalne
Dzięki ponad 20-letniemu doświadczeniu w dystrybucji IT współpracujemy z wiodącymi światowymi markami w celu dostarczania niezawodnych produktów i profesjonalnych usług.
Używanie technologii do budowy inteligentnego świata•Twój zaufany dostawca usług produktów ICT!