Az OpenAI szerint az Astra elérheti a kritikus kiberképességi szintet
Az OpenAI 2026. augusztus 7-én közölte, hogy az Astra nevű, készülő modelljének friss belső értékelései jelentős előrelépést mutatnak az ügynöki kódolásban és a kiberbiztonságban. A vállalat szerint jelenleg nem zárható ki, hogy a modell eléri a Preparedness Framework szerinti kritikus kiberképességi szintet.
- Az OpenAI szerint az Astra előzetes értékelései jelentős fejlődést mutatnak ügynöki kódolásban és kiberbiztonságban.
- A vállalat jelenleg nem tudja kizárni, hogy a modell eléri a Preparedness Framework szerinti Critical kiberküszöböt.
- Az Astra készülő modell, az OpenAI szerint nem vett részt a Hugging Face kihasználásában.
- A cég szigorúbb biztonsági kontrollokat, monitorozást és izolált tesztkörnyezeteket vezet be.
- Az OpenAI kormányzati szervekkel és kiválasztott MI-biztonsági szervezetekkel is tesztelné a modell képességeit.
Mit állít az OpenAI az Astráról?
Az OpenAI közlése szerint a kiberbiztonság gyorsan változik, ahogy a modellek egyre nagyobb képességeket kapnak. Ezek a képességek a vállalat megfogalmazása szerint erősíthetik a kibervédelmet, de példátlan sebességű és léptékű támadásokat is lehetővé tehetnek.
A cég az elmúlt napokban végzett belső értékelései alapján jutott arra, hogy az Astra esetében jelentős fejlődés látható az ügynöki kódolásban és a kiberbiztonsági feladatokban. Az OpenAI azt írta, hogy az eredmények és szakértői értékelések alapján előző este arra a következtetésre jutottak: nem tudják kizárni a kritikus kiberképességek meglétét a Preparedness Framework alapján.
A vállalat külön jelezte, hogy az Astra egy készülő modell, és nem vett részt a Hugging Face kihasználásában. Korábbi modelleket, köztük a GPT‑5.6‑Sol modellt is értékelték határterületi kiberképességekre, ezek az OpenAI szerint a High, nem pedig a Critical küszöböt érték el.
Mit jelent a kritikus kiberbiztonsági küszöb?
Az OpenAI Preparedness Framework nevű keretrendszere szerint egy modell akkor éri el a kritikus kiberbiztonsági küszöböt, ha emberi beavatkozás nélkül képes működő nulladik napi sebezhetőségeket azonosítani és fejleszteni több, megerősített, valós kritikus rendszerben, minden súlyossági szinten. A kritikus szinthez az is elegendő lehet, ha a modell csak egy magas szintű cél alapján képes teljesen új, végponttól végpontig tartó kibertámadási stratégiákat kidolgozni és végrehajtani megerősített célpontok ellen.
A vállalat hangsúlyozta, hogy továbbra is méri és értékeli a modellt. A mostani előzetes értékelések azonban az OpenAI szerint elég erős teljesítményt mutatnak ahhoz, hogy jelenleg ne lehessen kizárni a Critical képességszintet.
Az OpenAI először 2023 decemberében tette közzé a Preparedness Frameworköt. A cég szerint ezt azért hozták létre, hogy irányt adjon a képességek fejlődésének azonosításához, valamint ahhoz, mit tegyen a vállalat, amikor ilyen képességek megjelennek.
Szigorúbb kontrollokat vezetnek be
Az OpenAI közölte, hogy megnövelte a védelmi intézkedések és biztonsági kontrollok robusztussági tesztelését, hogy azok megfeleljenek egy ilyen képességű modell telepítéséhez. A vállalat belső lépéseket is bejelentett annak érdekében, hogy az Astra további fejlesztése biztonságosan történjen.
- Szigorúbb biztonsági kontrollokat vezetnek be a nagyobb képességű modellekhez és a kapcsolódó tevékenységekhez, köztük izolált tesztkörnyezeteket, korlátozott hálózati és eszközhozzáférést, megerősített modellparaméter-védelmet és titkosítást, további monitorozási és észlelési képességeket, valamint sandboxolt futtatást.
- Felfüggesztik azokat a belső, Astrával kapcsolatos tevékenységeket, amelyek még nem felelnek meg a megerősített biztonsági kontrollkövetelményeknek.
- Általános monitorozást vezettek be a kockázatos műveletekre és az eltérésekre az Astra összes ügynöki alkalmazásában, beleértve a tréninget és az értékelést.
- A monitorok a modell Chain of Thought folyamatát értékelik, és biztonsági választ indítanak a magas kockázatú tevékenység felülvizsgálatára és megszakítására.
- A vállalat együttműködik illetékes kormányzati szervekkel és kiválasztott MI-biztonsági szervezetekkel a modell képességeinek tesztelésében.
Az OpenAI azt is közölte, hogy ajánlott biztonsági kontrollokat ad harmadik fél tesztelőpartnereinek a nagyobb kockázatú értékelések és munkaterhelések biztonságos futtatásához.
Miért fontos ez a felhasználóknak és a piacnak?
A bejelentés jelentősége, hogy az OpenAI saját keretrendszere alapján egy készülő modellnél olyan kiberképességi szintet tart lehetségesnek, amely már a megerősített valós rendszerek elleni önálló támadási stratégiák és nulladik napi kihasználások területét érinti. Ez közvetlenül érinti a biztonsági tesztelés, a hozzáférés-kezelés és a külső értékelések szerepét.
A vállalat szerint a keretrendszer korábban más képességváltásoknál is irányt adott. 2025 júniusában, amikor a modelljeik a biológiai terület High küszöbéhez közelítettek, az OpenAI már lépéseket vázolt fel a védelmi intézkedések erősítésére, a tesztelés bővítésére, külső szakértők bevonására és további biztonsági kontrollok bevezetésére. A cég közlése szerint most ugyanezt az elvet alkalmazza a kiberképességeknél.
Az OpenAI álláspontja szerint a fejlett kiberképességű modelleknek abban kell segíteniük a védőket, hogy a támadók előtt azonosítsák és kezeljék a sebezhetőségeket. A vállalat azt ígéri, hogy kormányokkal, biztonsági intézetekkel és civil társadalmi szereplőkkel dolgozik együtt az Astra és a későbbi modellek határterületi képességeinek felelős bevezetéséért.


