NVIDIA Blackwell GPU-kon gyorsul az OpenAI GPT-6 Astra Ultrafast

Az NVIDIA 2026. október 1-jén közölte, hogy az OpenAI GPT-6 Astra Ultrafast módja NVIDIA Blackwell GPU-kon fut, és már elérhető az OpenAI API-ban, valamint jogosult ChatGPT Work és Codex felhasználóknak.
- A GPT-6 Astra Ultrafast NVIDIA Blackwell GPU-kon fut.
- Az NVIDIA szerint akár 8-szor gyorsabb tokengenerálást kínál az Astra Standard módnál.
- A mód elérhető az OpenAI API-ban, valamint jogosult ChatGPT Work és Codex felhasználóknak.
- Az OpenAI saját modelljeit is használja a NVIDIA GPU-kon futó következtetés optimalizálására.
- A gyorsulás főként kódoló ügynökök és interaktív alkalmazások munkafolyamataiban lehet fontos.
Akár 8-szor gyorsabb tokengenerálás
Az NVIDIA közlése szerint a GPT-6 Astra Ultrafast az OpenAI modelljein alkalmazott következtetési optimalizációkkal használja ki az NVIDIA Blackwell architektúra képességeit. A vállalat azt állítja, hogy az Ultrafast mód akár 8-szor gyorsabb tokengenerálást kínál az Astra Standard módhoz képest.
A bejelentés elsősorban fejlesztői felhasználásra helyezi a hangsúlyt. Az NVIDIA szerint a gyorsabb generálás lerövidítheti a kódoló ügynökök szerkesztés, tesztelés és hibakeresés közötti ciklusait, csökkentheti az eszközhívások közötti válaszgenerálás idejét, és reszponzívabbá teheti az interaktív alkalmazásokat.
A cég példája szerint a válaszidő akkor számít különösen, amikor egy munkafolyamatban ismétlődő lépésekről van szó: egy ügynök kódot ír, eszközt használ, ellenőrzi az eredményt, majd eldönti a következő lépést. Az NVIDIA megfogalmazása szerint az Ultrafast az Astra képességeit ezekbe az időérzékeny folyamatokba viszi be.
OpenAI: a modellek is segítik az optimalizálást
Az NVIDIA blogbejegyzése szerint a teljesítmény javítása nem áll meg a modell bevezetésekor. Az OpenAI saját modelljeit is használja a NVIDIA GPU-kon futó következtetési szoftver finomítására, kihasználva a platform programozhatóságát a fejlesztések tesztelésére és bevezetésére.
Philippe Tillet, az OpenAI következtetési vezetője a forrás szerint így fogalmazott: „Az NVIDIA eszközökbe és dokumentációba tett mély befektetése lehetővé tette számunkra, hogy modelljeinket kivételesen jóvá tegyük a Blackwell és Rubin GPU-k programozásában.” Hozzátette, hogy az Astra ezt a tudást nagy teljesítményű kernelekké tudja alakítani, az Astra Ultrafast esetében pedig ez gyorsabb modellválaszokat jelent, miközben az ügynökök kódot írnak, eszközöket használnak és összetett feladatokon dolgoznak.
Uday Ruddarraju, az OpenAI számítási területért felelős technológiai vezetője szintén az NVIDIA-val végzett munkát emelte ki. A forrás szerint azt mondta: „Belső modelljeinket használtuk a NVIDIA GPU-kon futó következtetés optimalizálására, és az NVIDIA programozhatósága segített elérnünk az Astra Ultrafast mögötti gyorsítást.”
Mit jelent ez a fejlesztőknek és az infrastruktúrának
A felhasználói oldalról a bejelentés legfontosabb következménye a rövidebb válaszidő lehet azokban a fejlesztői folyamatokban, ahol a modell sok egymást követő lépésben dolgozik. Az NVIDIA szerint ez különösen a kódoló ügynököknél, az eszközhívások közötti válaszoknál és az interaktív alkalmazásoknál lehet érezhető.
Az infrastruktúra szintjén az NVIDIA azt emeli ki, hogy a programozható platform lehetővé teszi a fejlesztőknek és kutatóknak az infrastruktúra újrafelhasználását tanítás, következtetés és megerősítéses tanulás során, ahogy a modellek fejlődnek. A forrás szerint ez a rugalmasság segíthet a számítási erőforrások átcsoportosításában, amikor változik a kereslet, javítva a kihasználtságot és elkerülve, hogy minden munkaterheléshez külön túlméretezett kapacitást tartsanak fenn.
A GPT-6 Astra Ultrafast az NVIDIA közlése szerint már használható az API-n keresztül. A hozzáférésről, árakról és megvalósítási részletekről a vállalat az Ultrafast útmutató megtekintését javasolja.

