A CoreWeave 100 millió dollárból bővíti NVIDIA GPU-infrastruktúráját

A CoreWeave 100 millió dolláros stratégiai befektetést kapott a Magnetartól, amelyet NVIDIA GPU-kkal gyorsított infrastruktúrájának bővítésére fordít. A vállalat 2023 első negyedévére NVIDIA H100 alapú felhős számítási kapacitást ígér ügyfeleinek.
- A Magnetar 100 millió dollárral támogatta a CoreWeave-et 2022 decemberében.
- A CoreWeave 2023 első negyedévére NVIDIA H100 GPU-kat ígér felhőszolgáltatásában.
- A H100 kapacitásának kezdőára a közlés szerint óránként 2,23 dollár.
- A vállalat új tárhelyet, modellpéldákat és startupgyorsító programot indított.
- A CoreWeave új New York-i adatközpontot nyitott, csapata pedig több mint 70 főre bővült.
A befektetés az AI-számítási kapacitást bővíti
A CoreWeave közlése szerint a Magnetar 2022 decemberében 100 millió dollárral támogatta a vállalatot. A stratégiai finanszírozás célja olyan infrastruktúra kiépítése, amelyre a mesterséges intelligenciával és gépi tanulással foglalkozó cégeknek szükségük van.
A vállalat a befektetést közvetlenül az infrastruktúra méretezésére fordítja. Ennek részeként nagy kapacitású, NVIDIA GPU-kkal gyorsított számítási erőforrásokat kínálna AI- és gépi tanulási cégeknek, vizuális effektekkel foglalkozó stúdióknak, valamint vállalati és startup ügyfeleknek.
A CoreWeave szerint a keresletet az is erősíti, hogy a nagy nyelvi modellekre épülő termékek fejlesztése gyorsan terjed. A vállalat szerver nélküli Kubernetes-infrastruktúrája iránt olyan vállalkozások és kutatók érdeklődnek, akik LLM-ekkel működő termékeket készítenek.
GPT-NeoX-20B és a következő NVIDIA GPU-generáció
A CoreWeave NVIDIA A100 Tensor Core GPU-kból álló képzési fürtjén tanították az EleutherAI GPT-NeoX-20B modelljét. A vállalat beszámolója szerint ez a modell az év elején a legnagyobb nyilvánosan elérhető nyelvi modell volt. A megjelenés betekintést adott a nyílt forráskódú AI-rendszerek következő generációjába.
A CoreWeave 2023 első negyedévében tervezi elérhetővé tenni ügyfelei számára az NVIDIA H100 Tensor Core GPU-kat. A cég ezzel az elsők között kínálna felhős példányokat H100 alapú szuperszámítógépekből. Az ügyfelek a közlemény szerint már lefoglalhatják a kapacitást, amely 2023 első negyedévében lesz szélesebb körben elérhető, óránként 2,23 dolláros kezdőárral.
Az NVIDIA H100 negyedik generációs Tensor Core egységeket és Transformer Engine-t használ FP8 pontossággal. Az NVIDIA állítása szerint a GPU nagy nyelvi modellek tanításánál akár kilencszeres gyorsulást, következtetésnél pedig harmincszoros gyorsulást kínálhat. Nagy teljesítményű számítási feladatoknál a vállalat akár hétszeres teljesítménynövekedést említ.
Új tárhely, integrációk és startupprogram
A CoreWeave 2022-ben több új szolgáltatással és együttműködéssel bővítette felhőplatformját. Az objektumtárhely nagy mennyiségű strukturálatlan adat tárolását célozza, havi 0,03 dolláros gigabájtonkénti kezdőárral, hozzáférési és adatátviteli díj nélkül.
A vállalat integrációkat indított a Determined.AI, a Zeet és az EleutherAI megoldásaival. Emellett példákat adott nagy nyelvi modellek és generatív AI-modellek, köztük a BLOOM és a Stable Diffusion finomhangolására és kiszolgálására. A Goose AI menedzselt API-ként kínál előre betanított, nyílt forráskódú modelleket.
A CoreWeave Accelerator Program NVIDIA GPU-kkal gyorsított számítási erőforrásokat biztosít innovatív startupoknak, igény szerint és nagy léptékben. A program a vállalat szerint láthatóságot, valamint új kapcsolat- és partnerségi lehetőségeket is nyújt a résztvevőknek.
Távoli animáció és japán nyelvű AI
A CoreWeave ügyfélpéldái között szerepel a Spire Animation Studios, amely felhőalapú munkafolyamatot használt egy teljes animációs film fejlesztéséhez az Unreal Engine segítségével. A stúdió mérnöki vezetése szerint a csapat tagjai az Egyesült Államok különböző pontjairól, valós időben tudtak együtt dolgozni.
Rajesh Sharma, a Spire Animation Studios mérnöki alelnöke úgy fogalmazott: „A gyorsabb iterációk révén többet tudunk végrehajtani, a finomítási folyamat pedig, akár az ellenőrzésről, a világítás módosításáról vagy a karakterek mozgatásáról van szó, interaktívan elvégezhető, ahelyett hogy egy hagyományos környezetben 2 vagy 3 órát várnánk a renderelésre.”
A Bit192 csapata NVIDIA GPU-kon tanított be egy 20 milliárd paraméteres japán modellt. A vállalat AI Novelist nevű chatbotmotorja írói asszisztensként működik, és a közlés szerint japán hivatásos írók, szerkesztők és alkalmi felhasználók is használják történetek és haikuk készítésére.
Új adatközpont és nagyobb csapat
A CoreWeave új adatközpontot nyitott New York régiójában, LGA1 néven. A létesítmény a vállalat szerint több mint 20 millió, New York térségében élő ember számára biztosít alacsony késleltetést, Manhattan felé pedig 1 milliszekundum alatti késleltetést. A helyszínen csak CPU-t használó példányok, valamint nagy teljesítményű blokk- és megosztott fájlrendszeres tárhely is elérhető.
A cég központja a New Jersey állambeli Roselandbe került, további irodái Brooklynban és Philadelphiában működnek. A CoreWeave beszámolója szerint a korábbi háromfős csapat több mint 70, az Egyesült Államokban dolgozó alkalmazottra bővült.
A bejelentések a felhasználók számára nagyobb GPU-kapacitást, új tárolási és modellkiszolgálási lehetőségeket, valamint startupoknak szóló erőforrást jelenthetnek. A CoreWeave szerint a generatív AI terjedéséhez olyan infrastruktúrára van szükség, amely képes követni a növekvő számítási igényt.


