Többszörösére nőtt több frontier AI-modell kockázati indexe
Többszörösére emelkedett a vizsgált frontier AI-modellek kockázati indexe egy év alatt, és több modell átlépte a Concordia AI által meghatározott képességküszöböt. A jelentés szerint a modellek képességei gyorsabban fejlődnek, mint egyes biztonsági védelmeik.
- A kiberkockázati index átlagosan 4,4-szeresére nőtt.
- A biológiai kockázati index 6,6-szorosára emelkedett.
- 22 modell lépte át a képességküszöböt biológiai kockázatoknál.
- A Gemini 3.1 Pro Preview vezette a biológiai és irányításvesztési indexet.
- Jailbreaktámadások után több területen meredeken romlott a modellek biztonsági pontszáma.
47 modellt vizsgáltak az új keretrendszerrel
A Concordia AI augusztus 13-án tette közzé a 2026 második negyedévére vonatkozó kockázatfigyelési jelentését. A beszámoló a Frontier AI Risk Monitoring Platform v2.0 rendszerére épül, amelyet a vállalat július 19-én mutatott be a World Artificial Intelligence Conference rendezvényen.
Az új Risk Index v2.0 azt vizsgálja, hogy egy modell képességeinek növekedésével mennyire emelkedhet a veszély, illetve mennyi kockázat marad fenn a biztonsági intézkedések alkalmazása után. A frissített értékelés fejlettebb jailbreakteszteket és életszerűbb feladatokat is használ.
A jelentés 47, 13 vezető AI-vállalat által kiadott modellt fed le, amelyek 2025 harmadik negyedéve és 2026 második negyedéve között jelentek meg. A vizsgált rendszerek között szerepel többek között a GPT-5.5, a Claude Opus 4.8, a Gemini 3.1 Pro Preview, a Grok 4.3 és a DeepSeek V4 Pro.
A kiber- és biológiai kockázatok emelkedtek a leggyorsabban
A Concordia AI szerint az átlagos kockázati index kevesebb mint egy év alatt 4,4-szeresére nőtt a kiberbűnözéshez, 6,6-szorosára a biológiai kockázatokhoz, és 2,4-szeresére az irányítás elvesztéséhez kapcsolódó területen.
A képességküszöböt, vagyis a Capability Yellow Line-t négy modell lépte át kiberbűnözésben, 22 biológiai kockázatoknál, és 12 az irányítás elvesztéséhez kapcsolódó értékelésben. Ez a Concordia AI meghatározása szerint azt jelenti, hogy megfelelő védelem nélkül a modell jelentősen növelheti a súlyos károk kockázatát a mesterséges intelligencia nélküli alapállapothoz képest.
A Gemini 3.1 Pro Preview érte el a legmagasabb biológiai és irányításvesztési kockázati indexet, és mindkét területen átlépte a kockázati küszöböt is. A DeepSeek V4 Pro kiberbűnözési indexe volt a legmagasabb, az irányításvesztési indexe pedig a második legmagasabb értéket mutatta.
A cég külön figyelmeztetett arra, hogy az új keretrendszer benchmarkjai és számítási módszerei jelentősen változtak, ezért az eredmények nem hasonlíthatók össze tételenként a korábbi v1.0 vagy v1.5 értékekkel.
A biztonsági védelmek több területen lemaradtak
A jelentés szerint a zárt, saját fejlesztésű modellek több területen továbbra is vezetnek a képességekben. A nyílt súlyú modellek biztonsági pontszámai ugyanakkor jelentősen alacsonyabbak voltak a kiber-, biológiai, vegyipari és káros manipulációs kockázatoknál.
A sérülékenységek hosszú távú kihasználását mérő CyBench legjobb modellpontszáma kevesebb mint egy év alatt 68 százalékkal, a CVE-Bench eredménye pedig 35 százalékkal javult. Ezzel párhuzamosan az átlagos kiberbiztonsági pontszám a legutóbbi negyedévben 3 százalékkal csökkent, a promptinjekciók elleni védelem pedig visszaesett.
A fejlett jailbreaktámadások után az átlagos biztonsági pontszám biológiai kockázatoknál 78,2-ről 8,9-re, kiberbűnözésnél 90,5-ről 29,2-re csökkent. A Claude Opus 4.8 ilyen támadások során 69,1 százalékos átlagos megtagadási arányt ért el, míg a Hunyuan T1 (250711) 5,8 százalékot.
A Concordia AI a fejlesztőknek azt javasolja, hogy különösen azokat a modelleket vizsgálják, amelyek átlépik a kockázati küszöböt, és javítsák az alapbiztonságot, a jailbreak-ellenállást, valamint az irányításvesztéssel szembeni védelmet.


