Elérhető a VAST AI OS 5.5, egy platformba vonja az AI-adatfolyamatokat

Általánosan elérhetővé vált a VAST AI OS 5.5, amely a vektoros keresést, az analitikai végrehajtást, az AI-adatfolyamatokat és a Kubernetes-feladatokat egy platformon kezeli. A VAST szerint a kiadás célja az adatmozgatás és a különálló infrastruktúrák számának csökkentése.
- Elérhetővé vált a VAST AI OS 5.5.
- A VAST Hyperscale Vector Index 1 milliárd, 128 dimenziós vektornál 10-szer gyorsabb lekérést ért el a vállalat benchmarkjában.
- A Native Query Engine több mint 50 új aggregációs és statisztikai függvényt támogat.
- A VAST Native Compute menedzselt Kubernetes-klasztereket futtat a VAST-klaszteren belül.
- Az Instant Data Cloning for Block metaadat-műveletté alakítja a blokkszintű másolást.
Vektoros keresés közvetlenül az adatbázisban
A VAST AI OS 5.5 egyik központi újdonsága a VAST Hyperscale Vector Index. A rendszer a VAST vector store-ban működő, saját fejlesztésű hierarchikus klaszterezési indexet használja, amely natívan beépül a VAST DataBase-be.
A megközelítés többszintű, távolság-alapú klaszterekbe rendezi a vektorokat. A lekérdezés minden szinten korlátozott számú klasztert vizsgál, majd csak a legígéretesebb jelöltek felé halad tovább. A VAST leírása szerint emiatt a lekérdezési késleltetés a rendszer méretének növekedésével nem lineárisan emelkedik. A kvantált vektoroknak csak a célzott részei kerülnek memóriába, így a keresés nem a teljes index memóriában tartásától függ.
A vállalat benchmark-összehasonlítása szerint a megoldás 1 milliárd, egyenként 128 dimenziós vektornál 10-szer gyorsabb vektorlekérést ért el vezető nyílt forráskódú vektoradatbázisokhoz képest. Mivel a vektorok strukturált és félig strukturált adatok mellett maradnak a VAST DataBase-ben, a hasonlósági keresés SQL-szűrésekkel, összekapcsolásokkal és metaadat-feltételekkel is kombinálható egyetlen végrehajtási útvonalon.
Több analitika adatmozgatás nélkül
A VAST Native Query Engine több mint 50 új aggregációs és statisztikai függvénnyel bővült. Ezek között szerepel a variancia, a szórás, a regresszióelemzés, a korreláció, a kvantilisbecslés és a feltételes aggregációt lehetővé tevő FILTER záradék.
A VAST szerint így a korábban külső rendszerekbe exportált statisztikai elemzések, a gépi tanulási jellemzők előkészítése és a feltáró adatelemzés közvetlenül az adatok mellett futtatható. Az új motor a vektoros keresést és az SQL-szűrést is ugyanabban a lekérdezési útvonalban kezeli.
A nagy táblák elemzését SQL-alapú deklaratív particionálás segíti. A felhasználók idő, kategória vagy más logikai dimenzió szerint adhatják meg a particionálási szándékot, a VAST pedig automatikusan alkalmazza a partíciók metszését, az összekapcsolások optimalizálását és a hatékony törléseket. A vállalat Iceberg-alapú táblákkal végzett összehasonlításában a szelektív lekérdezések több mint 60 százalékkal gyorsabbak voltak, a frissítések 200-szor gyorsabban futottak, egy valós gyártási környezetben pedig az összesített futási idő körülbelül 20 százalékkal javult.
Menedzselt pipeline-ok és azonnali klónozás
A VAST Native Compute konténerorchesztrációt visz be a VAST AI OS-be a DataEngine-funkciók számára. Az adminisztrátorok menedzselt Kubernetes-klasztereket hozhatnak létre a VAST-klaszteren belüli CNode-okon, dedikált számítási kapacitást biztosítva a konténeres pipeline-feladatokhoz. A platform kezeli a létrehozást, a skálázást, a frissítéseket és az életciklus-műveleteket.
Így a vektorizálás, a dokumentum- és videódarabolás, a beágyazások létrehozása, valamint az eseményvezérelt függvények a feldolgozott adatok közelében futtathatók. Az NFS-hez készült File-Triggered Pipelines az NFSv4 fájlrendszer-eseményeit, például a létrehozást, törlést és metaadat-változást is képes pipeline-ok indítására használni.
A kiadás eseménykötegelést, feltételes függvényirányítást és felhasználó által meghatározott metrikákat is kínál. A VAST ugyanakkor jelzi, hogy a modellkiszolgálás jelenleg továbbra is külső Kubernetesen fut, a natív számítási lehetőségeket későbbi kiadásokban terjesztik ki további munkatípusokra.
Az Instant Data Cloning for Block a blokkszintű másolást metaadat-műveletté alakítja. A platform a célterületet ugyanarra az alapul szolgáló flash-adatra hivatkoztatja, így a VAST szerint a virtuálisgép-klónozás, a Storage vMotion és az SMB szerveroldali másolása csaknem azonnal végrehajtható, tárhely-sávszélesség és írási pufferek felhasználása nélkül. A VAST AI OS 5.5 2026. augusztus 6-tól érhető el.
VAST Data: VAST AI OS 5.5 Is Generally Available

