Mesterséges intelligencia, magyarul.
Az eredeti közleményekből.

Többszörösére nőtt több frontier AI-modell kockázati indexe

2026. augusztus 13. 09:54Forrás: Concordia AI

Többszörösére emelkedett a vizsgált frontier AI-modellek kockázati indexe egy év alatt, és több modell átlépte a Concordia AI által meghatározott képességküszöböt. A jelentés szerint a modellek képességei gyorsabban fejlődnek, mint egyes biztonsági védelmeik.

A lényeg röviden
  • A kiberkockázati index átlagosan 4,4-szeresére nőtt.
  • A biológiai kockázati index 6,6-szorosára emelkedett.
  • 22 modell lépte át a képességküszöböt biológiai kockázatoknál.
  • A Gemini 3.1 Pro Preview vezette a biológiai és irányításvesztési indexet.
  • Jailbreaktámadások után több területen meredeken romlott a modellek biztonsági pontszáma.

47 modellt vizsgáltak az új keretrendszerrel

A Concordia AI augusztus 13-án tette közzé a 2026 második negyedévére vonatkozó kockázatfigyelési jelentését. A beszámoló a Frontier AI Risk Monitoring Platform v2.0 rendszerére épül, amelyet a vállalat július 19-én mutatott be a World Artificial Intelligence Conference rendezvényen.

Az új Risk Index v2.0 azt vizsgálja, hogy egy modell képességeinek növekedésével mennyire emelkedhet a veszély, illetve mennyi kockázat marad fenn a biztonsági intézkedések alkalmazása után. A frissített értékelés fejlettebb jailbreakteszteket és életszerűbb feladatokat is használ.

A jelentés 47, 13 vezető AI-vállalat által kiadott modellt fed le, amelyek 2025 harmadik negyedéve és 2026 második negyedéve között jelentek meg. A vizsgált rendszerek között szerepel többek között a GPT-5.5, a Claude Opus 4.8, a Gemini 3.1 Pro Preview, a Grok 4.3 és a DeepSeek V4 Pro.

A kiber- és biológiai kockázatok emelkedtek a leggyorsabban

A Concordia AI szerint az átlagos kockázati index kevesebb mint egy év alatt 4,4-szeresére nőtt a kiberbűnözéshez, 6,6-szorosára a biológiai kockázatokhoz, és 2,4-szeresére az irányítás elvesztéséhez kapcsolódó területen.

A képességküszöböt, vagyis a Capability Yellow Line-t négy modell lépte át kiberbűnözésben, 22 biológiai kockázatoknál, és 12 az irányítás elvesztéséhez kapcsolódó értékelésben. Ez a Concordia AI meghatározása szerint azt jelenti, hogy megfelelő védelem nélkül a modell jelentősen növelheti a súlyos károk kockázatát a mesterséges intelligencia nélküli alapállapothoz képest.

A Gemini 3.1 Pro Preview érte el a legmagasabb biológiai és irányításvesztési kockázati indexet, és mindkét területen átlépte a kockázati küszöböt is. A DeepSeek V4 Pro kiberbűnözési indexe volt a legmagasabb, az irányításvesztési indexe pedig a második legmagasabb értéket mutatta.

A cég külön figyelmeztetett arra, hogy az új keretrendszer benchmarkjai és számítási módszerei jelentősen változtak, ezért az eredmények nem hasonlíthatók össze tételenként a korábbi v1.0 vagy v1.5 értékekkel.

A biztonsági védelmek több területen lemaradtak

A jelentés szerint a zárt, saját fejlesztésű modellek több területen továbbra is vezetnek a képességekben. A nyílt súlyú modellek biztonsági pontszámai ugyanakkor jelentősen alacsonyabbak voltak a kiber-, biológiai, vegyipari és káros manipulációs kockázatoknál.

A sérülékenységek hosszú távú kihasználását mérő CyBench legjobb modellpontszáma kevesebb mint egy év alatt 68 százalékkal, a CVE-Bench eredménye pedig 35 százalékkal javult. Ezzel párhuzamosan az átlagos kiberbiztonsági pontszám a legutóbbi negyedévben 3 százalékkal csökkent, a promptinjekciók elleni védelem pedig visszaesett.

A fejlett jailbreaktámadások után az átlagos biztonsági pontszám biológiai kockázatoknál 78,2-ről 8,9-re, kiberbűnözésnél 90,5-ről 29,2-re csökkent. A Claude Opus 4.8 ilyen támadások során 69,1 százalékos átlagos megtagadási arányt ért el, míg a Hunyuan T1 (250711) 5,8 százalékot.

A Concordia AI a fejlesztőknek azt javasolja, hogy különösen azokat a modelleket vizsgálják, amelyek átlépik a kockázati küszöböt, és javítsák az alapbiztonságot, a jailbreak-ellenállást, valamint az irányításvesztéssel szembeni védelmet.

Concordia AIFrontier AI Risk Monitoring PlatformRisk Index v2.0GPT-5.5Claude Opus 4.8Grok 4.3AI-biztonságkiberbiztonságkutatási eredménybenchmark

Kapcsolódó hírek

Kutatás: az AI-s gyűlöletbeszéd-felismerés maga is keretek közé szorít
Kutatás2026. szeptember 30. 12:34

Kutatás: az AI-s gyűlöletbeszéd-felismerés maga is keretek közé szorít

A gyűlöletbeszéd mesterséges intelligenciával végzett felismerését alapvetően meghatározza, hogyan írják le magát a nyelvet. A Minderoo Centre for Technology & Democracy…

A gyűlöletbeszéd technikai definíciója meghatározza, mit lát az AI
Kutatás2026. szeptember 30. 12:34

A gyűlöletbeszéd technikai definíciója meghatározza, mit lát az AI

A gyűlöletbeszéd automatikus felismerését kutató tudományterületek eltérően értelmezik a nyelvet és a károkat. Stefanie Ullmann tanulmánya szerint ezek a kiindulópontok…

Az AI-ügynökök miatt új megközelítést sürget a kiberbiztonságban az IAPS
Biztonság és etika2026. szeptember 29. 15:40

Az AI-ügynökök miatt új megközelítést sürget a kiberbiztonságban az IAPS

Az önálló kibertámadások végrehajtására képes AI-ügynökök megjelenése miatt az amerikai kiberbiztonsági felkészültség megerősítését sürgeti az Institute for AI Policy…