Mesterséges intelligencia, magyarul.
Az eredeti közleményekből.

A Mistral AI és a CoreWeave az NVIDIA GTC-n mutatta be együttműködését

2026. október 2.Forrás: CoreWeave
A Mistral AI és a CoreWeave az NVIDIA GTC-n mutatta be együttműködését
Kép: CoreWeave

A Mistral AI és a CoreWeave az NVIDIA GTC konferencián mutatta be együttműködését, amely a Mistral AI modelljeinek fejlesztését és betanítását támogatja. A partnerség részeként a Mistral AI hackathont is szervezett a CoreWeave felhőplatformján.

A lényeg röviden
  • A Mistral AI és a CoreWeave az NVIDIA GTC-n mutatta be partnerségét.
  • A Mistral AI nyílt és kereskedelmi modelleket is fejleszt.
  • A modellek betanításához CoreWeave Cloudon futó NVIDIA H100 GPU-kat használtak.
  • A Mistral AI hackathont szervezett a CoreWeave felhőplatformján.
  • A CoreWeave szerint a partnerség gyorsabb és stabilabb modellfejlesztést támogat.

Nyílt és kereskedelmi modelleket fejleszt a Mistral AI

A CoreWeave 2026. október 2-án közzétett beszámolója szerint a Mistral AI rövid idő alatt a generatív mesterséges intelligencia meghatározó szereplőjévé vált. A párizsi startupot Arthur Mensch, Timothée Lacroix és Guillaume Lample alapította. Mensch korábban a Google DeepMindnál dolgozott, Lacroix és Lample pedig a Meta párizsi AI-laboratóriumának munkatársa volt.

A vállalat nyílt súlyú és kereskedelmi modelleket is készít. A forrás a Mistral-7B és a Mixtral-8x7B nyílt modelleket, valamint a Mistral Small, Mistral Medium és Mistral Large kereskedelmi modelleket említi. A cég La Plateforme néven API-szolgáltatást, Le Chat néven pedig többnyelvű chatbotot is kínál.

A CoreWeave a Mistral Large modellt a vállalat legfejlettebb, felső kategóriás kereskedelmi modelljeként mutatja be. A beszámoló szerint a modell kódolási és matematikai feladatokban is használható, öt nyelven, franciául, angolul, németül, spanyolul és olaszul működik, továbbá egyetlen hívásban több száz oldalnyi dokumentumot képes feldolgozni. A benchmarkeredmények alapján a CoreWeave szerint a Mistral Large az API-n keresztül elérhető modellek között a második helyen állt a GPT-4 mellett.

CoreWeave-felhőn tanították a modelleket

A két vállalat együttműködésének központi eleme az infrastruktúra. A Mistral AI a CoreWeave Cloud NVIDIA H100 Tensor Core GPU-kból álló fürtjét használta modelljei betanításához. A CoreWeave szerint ez is hozzájárult ahhoz, hogy a startup az alapítása után néhány hónappal kiadhassa a Mistral-7B modellt.

Arthur Mensch a beszámolóban azt mondta, hogy a Mistral AI és a CoreWeave csapatai közösen építették ki a modellek betanítására szolgáló fürtöket. A Mistral AI vezérigazgatója szerint a CoreWeave-fürtök teljesítménye, megbízhatósága és stabilitása lehetővé tette, hogy gyorsan új modelleket szállítsanak.

A CoreWeave bevételi alelnöke, Max Hjelm szerint a Mistral AI rövid idő alatt iparági vezetővé vált, és a felhőszolgáltató büszke arra, hogy támogathatja a vállalat növekedését. Ezek a megállapítások a CoreWeave saját közlését tükrözik.

Előadások és hackathon az NVIDIA GTC-n

Az együttműködést az NVIDIA GTC globális AI-konferencián is bemutatták. A program szerint Arthur Mensch és Max Hjelm a konferencia 1208-as standján tartott élő beszélgetést. Mensch emellett egy külön előadáson beszélt a Mistral AI nyílt forrású nagy nyelvi modelljeinek gyors fejlesztéséről, valamint a Mistral és Mixtral első modelljeinek betanítása során szerzett tudományos tapasztalatokról.

A konferencia után a Mistral AI a San Francisco-öböl térségében maradt, hogy megtartsa első hackathonját. Az eseményt a CoreWeave Cloud infrastruktúráján rendezték meg.

A partnerség a felhasználók és a fejlesztők számára azt jelenti, hogy a Mistral AI modellfejlesztése mögött olyan felhőinfrastruktúra áll, amelyet a vállalatok közösen alakítottak ki. A CoreWeave beszámolója alapján az együttműködés egyszerre szolgálja a modellbetanítás sebességét, az infrastruktúra stabilitását és a nyílt súlyú AI-megoldások fejlesztését.

Kapcsolódó hírek

600 terabájt videót címkézett fel 95 perc alatt a CoreWeave és az Anyscale
Chipek és infrastruktúra2026. október 2.

600 terabájt videót címkézett fel 95 perc alatt a CoreWeave és az Anyscale

A CoreWeave és az Anyscale 600 terabájtnyi videó feldolgozását végezte el 95 perc alatt, egy 1600 NVIDIA GPU-ból álló klaszteren. A vállalatok szerint a fiók…

A CoreWeave szerint a modell élesítése csak a fejlesztési ciklus kezdete
Fejlesztőknek2026. október 2.

A CoreWeave szerint a modell élesítése csak a fejlesztési ciklus kezdete

A CoreWeave szerint egy modell vagy ügynök élesítése után kezdődik az igazán értékes tanulási szakasz. A vállalat és a Weights & Biases ezt AI Loopnak nevezi, amely a…

A CNCF Sandboxba kerül az llm-d, az AI-inferencia nyílt infrastruktúrája
Fejlesztőknek2026. október 2.

A CNCF Sandboxba kerül az llm-d, az AI-inferencia nyílt infrastruktúrája

A Cloud Native Computing Foundation Sandbox projektjei közé kerül az llm-d, a több gyorsítós infrastruktúrán futó, elosztott következtetés összehangolására és…