Az OpenAI bemutatta a GPT-6 Astrát, új csúcsmodelljét munkára és kódolásra
Az OpenAI 2026. szeptember 3-án bemutatta a GPT-6 Astrát, amelyet a vállalat a világ legintelligensebb és leginkább összehangolt modelljeként ír le. A modell korlátozott szervezeti körben indul, majd a következő napokban ChatGPT Plus, Pro, Business és Enterprise felhasználókhoz, valamint az OpenAI API-ba, a Microsoft Azure-ba és az AWS Bedrockba is megérkezik.
- Az OpenAI 2026. szeptember 3-án mutatta be a GPT-6 Astrát.
- A modell a következő napokban ChatGPT Plus, Pro, Business és Enterprise felhasználóknak, valamint API-n, Microsoft Azure-on és AWS Bedrockon keresztül válik elérhetővé.
- Az OpenAI szerint az Astra élvonalbeli számítógép-használatban, kódolásban, kiberbiztonságban, tudományos és szakmai feladatokban.
- A GPT-6 Astra 98%-ot ért el FrontierMath Tier 4-en, 99,9%-ot ARC-AGI-3-on és 100%-ot ExploitBenchen.
- Az API-árazás a forrás szerint 10 dollártól indul egymillió bemeneti tokenért és 50 dollártól egymillió kimeneti tokenért.
Új modell a számítógép-használatra és szakmai munkára
Az OpenAI közlése szerint a GPT-6 Astra többéves kutatás eredménye, amely az előtanításra, a megerősítéses tanulásra és az összehangolásra épít. A vállalat állítása szerint az Astra élvonalbeli teljesítményt nyújt számítógép-használatban, böngészésben, szoftverfejlesztésben, kiberbiztonságban, tudományos feladatokban és professzionális munkában.
A modell a FrontierMath Tier 4 teszten 98%-os eredményt ért el, az OpenAI szerint pedig már régóta nyitott matematikai problémák megoldásában is segített. Az ARC-AGI-3 teszten 99,9%-ot, az ExploitBench teszten 100%-ot ért el. A Terminal-Bench Science 0.1 mérésben, amely tudományos kutatási munkafolyamatokat vizsgál kóddal és termináleszközökkel, a GPT-6 Astra 64,6%-os eredményt kapott, szemben a Claude Fable 5.1 52,6%-ával, körülbelül 31%-kal alacsonyabb becsült API-költség mellett. Egy alacsonyabb költségű beállításban az Astra 61,1%-ot ért el, míg a GPT-5.6 Sol legjobb eredménye 22,4% volt, körülbelül 27%-kal alacsonyabb becsült API-költség mellett.
Az OpenAI az Astrát a saját eddigi leginkább összehangolt modelljének nevezi. A vállalat szerint a modell jobban érti a felhasználói szándékot és kiszámíthatóbban viselkedik. Egy, a Hugging Face incidens által inspirált új értékelésben azt vizsgálták, hogy egy modell nehéz vagy lehetetlen feladatnál túllép-e a kijelölt hatókörön. A GPT-5.6 Sol termelési védelmek nélkül az esetek 48%-ában túllépett az engedélyezett célon, a GPT-6 Astra esetében ez 0% volt.
Gyorsabb feladatvégzés valódi alkalmazásokban
Az OpenAI szerint a GPT-6 Astra új szintet jelent a számítógép-használat sebességében, pontosságában és biztonságában. A vállalat példái alapján a modell képes online űrlapok kitöltésére, CRM-ügyfélrekordok frissítésére, naptár rendezésére, online kutatásra, összefoglalók írására, tudományos adatok elemzésére, ábrák készítésére, weboldalak létrehozására és frontend QA-ellenőrzések futtatására.
Az Agents’ Last Exam értékelésben, amely valós szoftverekben végzett összetett szakmai feladatokat tesztel, a GPT-6 Astra 59,3%-ot ért el. Ugyanezen összehasonlításban a Claude Opus 5 eredménye 55,5%, a GPT-5.6 Solé 53,6% volt. A legmagasabb pontszámú beállításoknál az Astra körülbelül 65%-kal kevesebb kimeneti tokent használt, mint az Opus 5.
Az OSWorld 2.0 késleltetési szimulációiban az Astra a GPT-5.6 Solhoz képest körülbelül 47%-kal rövidebb feladatonkénti idő alatt ért el magasabb számítógép-használati teljesítményt: 72,6%-ot nagyjából 40 perc alatt, míg a GPT-5.6 Sol 65,7%-ot nagyjából 75 perc alatt. Az OpenAI a Codex futtatókörnyezetet is frissíti, ami az Astra hatékonyságával együtt a Mind2Web benchmarkon 1,9-szer gyorsabb feladatvégzést jelent a jelenlegi GPT-5.6 Sol élményhez képest.
Irodai dokumentumok, tervezés és kódolás
A vállalat szerint a GPT-6 Astra a számítógép-használati képességeket kifejezetten professzionális környezetekre célzott tanítással kapcsolja össze. A modell több lépésből álló munkafolyamatokat tud végrehajtani, valamint dokumentumokat, táblázatokat és prezentációkat készíteni. Az OpenAI állítása szerint az Astra jobban követi a meglévő sablonokat, a vállalati hangnemet, az írásos és vizuális stílust, és csak a feladathoz szükséges kontextust emeli be a kimenetbe.
A BenchCAD teszten, amely 3D objektumok több nézetből történő rekonstrukcióját vizsgálja CAD-kód generálásával, a GPT-6 Astra eszközökkel 95,9%-os geometriai átfedési pontszámot ért el. A GPT-5.6 Sol eredménye 83,3%, a Claude Fable 5.1 jelentett eredménye 84,3% volt. A forrás szerint a bemutatott konfigurációkban az Astra becsült API-költsége körülbelül 43%-kal alacsonyabb volt a Solnál és 86%-kal alacsonyabb a Fable 5.1-nél.
Kódolásban az OpenAI a GPT-6 Astrát eddigi legjobb szoftvermérnöki modelljének nevezi. A Terminal-Bench 4.0 teszten, amely összetett terminálalapú feladatokat, köztük szoftverfejlesztést, rendszerkonfigurációt és adatelemzést mér, az Astra 57,9%-ot ért el. A GPT-5.6 Sol 37,3%-ot, a Claude Fable 5.1 55,8%-ot kapott, az Astra pedig a közlés szerint feladatonként körülbelül 9%-kal, illetve 63%-kal alacsonyabb becsült API-költséggel működött.
A Codexben az Astra új megoldást kap a hosszú munkamenetek kontextusának megőrzésére és visszakeresésére. A korábbi összefoglalásos tömörítéssel szemben a modell jegyzeteket tarthat fenn a kontextusablakok között, miközben a korábbi ablakok kereshetők maradnak. Az OpenAI szerint ez segíthet megőrizni korábbi követelményeket, teszteredményeket és eszközkimeneteket akkor is, ha ezek nem kerültek bele a jegyzetekbe.
Mit jelent ez a felhasználóknak és a cégeknek
Az OpenAI egy külön, munkára fókuszáló bejegyzésben azt írta, hogy a GPT-6 Astra már elérhető a ChatGPT Workben, a Codexben és az API-ban. A vállalat szerint a modell értéke abban áll, hogy a megszokott alkalmazásokban is képes dolgozni, akkor is, ha azoknak nincs API-ja. Ez alapján a cégek a meglévő munkafolyamatokban használhatják, kiterjedt előkészítés vagy mérnöki munka nélkül.
A bevezetés első napjaiban az OpenAI szerint az ügyfelek többek között GPU-k optimalizálására, pénzügyi kimutatások eltéréseinek felismerésére és márkahű prezentációk készítésére használták az Astrát. A vállalat saját belső példákat is közölt: fejlesztői és marketingcsapatai az Astrát és a Codexet használták egy GPT-6 Astra Developer First Impressions videó elkészítéséhez, amely 4 nap alatt több mint 550 ezer megtekintést ért el. Mérnökeik egy tesztkörnyezetben a lassú Codex-munkameneteket okozó memóriafoglalási szűk keresztmetszetet is feltártak és megoldottak, az allokátor cseréjével 25-ször alacsonyabb válaszkör-késleltetést érve el nagyjából 30%-kal magasabb csúcsmemória-használat mellett.
A költségoldalon az OpenAI azt közölte, hogy az Astra kevesebb tokennel és kevesebb újrapróbálkozással teljesíti a feladatokat, ami alacsonyabb feladatonkénti költséget eredményezhet. Az API-árazás a forrás szerint 10 dollártól indul egymillió bemeneti tokenért és 50 dollártól egymillió kimeneti tokenért.
