Mesterséges intelligencia, magyarul.
Az eredeti közleményekből.

A d-Matrix Demo Cloudban percek alatt kipróbálható a Corsair

2026. szeptember 15. 14:28Forrás: d-Matrix
A d-Matrix Demo Cloudban percek alatt kipróbálható a Corsair
Kép: d-Matrix

A d-Matrix új Demo Cloud szolgáltatása lehetővé teszi, hogy ügyfelek, partnerek és értékelők percek alatt kipróbálják a Corsair hardverre épülő AI-inferenciát. Ehhez nem kell saját infrastruktúrát kiépíteni, elegendő egy API-kulcs létrehozása.

A lényeg röviden
  • A Demo Cloud valódi Corsair hardveren futó AI-inferenciát tesz kipróbálhatóvá.
  • A teszteléshez előre létrehozott munkaterület és API-kulcs-kezelés tartozik.
  • A szolgáltatás OpenAI-kompatibilis kliensekkel és a Codex CLI-vel is használható.
  • Heterogén Speculative Decoding futtatható Corsair és GPU szerverek kombinációjával.
  • A d-Matrix Demo Cloud jelenleg várólistán keresztül érhető el.

Valódi hardveren tesztelhető a Corsair teljesítménye

A d-Matrix szeptember 15-i bejelentése szerint a Demo Cloud olyan hosztolt környezet, amelyben a felhasználók saját munkaterheléseiken vizsgálhatják meg a Corsair gyorsítóira épülő inferenciát. A szolgáltatás célja, hogy az érdeklődők még az értékesítési csapattal folytatott egyeztetés előtt közvetlen tapasztalatot szerezhessenek a rendszer működéséről.

A tesztelés valódi Corsair hardveren, produkciós használatra szánt modellekkel történik. A felhasználók inference végpontot indíthatnak, majd az általuk már használt OpenAI-kompatibilis eszközöket csatlakoztathatják hozzá. A d-Matrix szerint ehhez nem kell infrastruktúrát létrehozni, és a beállításra sem kell várni.

A Demo Cloud irányítópultján megjelenik, milyen végpontok vannak telepítve, mely API-kulcsok aktívak, és melyik alap URL-címet kell használni az OpenAI-kompatibilis kliensek kapcsolódásához. Minden bemutatóhoz előre létrehozott munkaterület tartozik, így a bejelentkezés után látható, mi érhető el és hogyan lehet elindítani a tesztet.

OpenAI-kompatibilis eszközökkel, átírás nélkül

A szolgáltatás önkiszolgáló API-kulcs-kezelést kínál. A felhasználó korlátozott hatókörű inference API-kulcsot hozhat létre, majd szabványos Bearer tokennel hitelesítheti magát az elérhető végpontokon. A d-Matrix ezt ahhoz a mintához hasonlítja, amelyet az OpenAI SDK használ.

A hosztolt modellek az OpenAI wire protokollján keresztül érhetők el, ezért a meglévő kliens lecserélése a vállalat szerint konfigurációs módosítás, nem teljes átírás. A támogatott lehetőségek között szerepelnek a chat completions kérések, a Responses API, valamint az olyan ügynökalapú kódolási eszközök, mint a Codex CLI.

A d-Matrix példaként azt mutatja be, hogy a Codex CLI vagy más OpenAI-kompatibilis kliens egy szolgáltatói beállítás hozzáadásával a Demo Cloud alap URL-címére irányítható. Így a felhasználó egy hosztolt modellen, például a Qwen3 235B-n futtathat valódi kódolási feladatokat.

A heterogén inferencia működését is meg lehet nézni

A Demo Cloud kétféle használatot tesz lehetővé. Az egyik a teljes modell futtatása Corsair szervereken, a másik a heterogén, szétválasztott inferencia GPU és Corsair szerverek kombinációjával. A rendszerhez előzetesen ellenőrzött telepítési konfigurációk tartoznak, ezért a felhasználónak nem kell maga elvégeznie a kapcsolódó hangolási munkát.

A d-Matrix külön kiemeli a heterogén Speculative Decoding inferenciát. Ennél a módszernél egy kisebb, úgynevezett javasló modell Corsair hardveren tokeneket javasol, egy nagyobb célmodell pedig GPU-n ellenőrzi ezeket. A Demo Cloud a Corsair és GPU-csomópontok közötti teljes vezérlést és összehangolást biztosítja.

A vállalat példájában a Qwen3 1.7B javasló modell két Corsair kártyán, a Qwen3 235B célmodell pedig négy H200 GPU-n fut. A katalógus végpontjai a Speculative Decoding módhoz, a számítási és memóriaerőforrásokhoz, valamint a chat completions és Responses API kompatibilitásához is előre beállított konfigurációkat kínálnak.

A d-Matrix a Demo Cloud képességeit az AI Infra Summit 2026 rendezvényen is bemutatja. A szolgáltatás iránt érdeklődők jelenleg várólistára iratkozhatnak fel, így a Corsairre épülő inferencia teszteléséhez nem kell azonnal saját infrastruktúrát kiépíteniük.

Kapcsolódó hírek

A Kilo Code szerint a biztonság lett az LLM-ek új kulcstényezője
Biztonság és etika2026. október 2. 23:19

A Kilo Code szerint a biztonság lett az LLM-ek új kulcstényezője

A nagy nyelvi modellek értékelésében a költség, a teljesítmény és a hatékonyság mellé a biztonság is bekerült. A Kilo Code szerint egy gyors és olcsó modell vállalati…

Modellek
Modellek2026. október 2. 18:15

Az OpenAI útmutatót adott ki a GPT-6 modellek használatához

Az OpenAI gyakorlati útmutatóban mutatja be, hogyan érdemes kiválasztani és használni a GPT-6 család modelljeit. A dokumentum a fejlesztési feladatoktól a több napon át…

Rekordot döntött a CoreWeave és az NVIDIA felhős AI-szuperszámítógépe
Chipek és infrastruktúra2026. október 2. 16:12

Rekordot döntött a CoreWeave és az NVIDIA felhős AI-szuperszámítógépe

A CoreWeave és az NVIDIA több mint 3500 NVIDIA H100 Tensor Core GPU-val, 11 percnél rövidebb idő alatt teljesítette az új MLPerf GPT-3 175B tesztet. A vállalatok szerint…