A Google bemutatta a Gemini 3.5 Flash Cyber kiberbiztonsági modellt
A Google DeepMind bemutatta a Gemini 3.5 Flash Cyber modellt, amelyet szoftveres sérülékenységek gyors felderítésére, ellenőrzésére és javítására hangoltak. A modellt kezdetben kormányzati szervezetek és megbízható partnerek használhatják a CodeMenderen keresztül.
- A Gemini 3.5 Flash Cyber sérülékenységek keresésére, ellenőrzésére és javítására készült.
- Kezdetben kormányzatok és megbízható partnerek férhetnek hozzá a CodeMenderen keresztül.
- A V8-on 55 egyedi, megerősített hibát talált, szemben a 3.5 Flash 47 és a Claude Opus 4.6 36 hibájával.
- A Google belső kódbázisaiban, köztük a Chrome és az Android projektjeiben is használják.
Korlátozott hozzáféréssel indul a modell
A Google DeepMind július 21-én ismertette a Gemini 3.5 Flash Cybert. A könnyű kiberbiztonsági modell a 3.5 Flashre épül, és a Google szerint kifejezetten a sérülékenységek megtalálására, validálására és javítására finomhangolták. A vállalat állítása szerint ezekben a feladatokban hatékonyabb a Gemini fő Flash modelljeinél.
A Google a modell kettős felhasználású technológiából fakadó kockázatai miatt fokozatos bevezetést választott. A Gemini 3.5 Flash Cyber egy korlátozott hozzáférésű pilotprogramban lesz elérhető, kizárólag kormányzatok és megbízható partnerek számára, a CodeMenderen keresztül. A hozzáférést később bővítenék.
A CodeMender a Google kódbiztonsági ügynöke, amely automatikusan képes kritikus szoftveres sérülékenységek keresésére és javítására. A vállalat ezzel párhuzamosan a CodeMender alapvető képességeit is elérhetővé teszi ügyfelei számára, általánosan hozzáférhető Gemini-modellekkel, a Gemini Enterprise Agent Platformon keresztül.
Több kódútvonalat vizsgálhat alacsonyabb költséggel
A Google szerint a mélyen rejtőző hibák feltárásához hatalmas végrehajtási keresési teret kell átvizsgálni. Egyetlen, költséges hívás egy nagyméretű nyelvi modellhez szűk keresztmetszetet jelenthet, különösen akkor, ha egy ügynök nagy kódbázist és sok kódútvonalat elemez.
A CodeMender ezért többször is meghívhatja a Gemini 3.5 Flash Cybert, majd az alügynökök eredményeiből egy jelentést állíthat össze. A modell sebessége és költséghatékonysága a Google szerint lehetővé teszi, hogy gyakori vizsgálatokba, időérzékeny kiadási folyamatokba vagy a kódváltoztatások ellenőrzésébe is beépítsék.
A CyberGym nevű teszten, amely több száz valós szoftveres sérülékenységgel értékeli az AI-ügynököket, a Google úgy konfigurálta a CodeMendert, hogy egy végleges jelentéshez legfeljebb ötször hívja meg a modellt. A vállalat szerint az így működő ügynök a jóval nagyobb modellekkel versenyképes teljesítményt ért el. A versenytársak eredményei a szolgáltatók saját közlésein alapulnak.
A Google belső kódbázisaiban is használják
A Google Big Sleep csapata külön vizsgálatot készített a kritikus és nehezen megtalálható hibák felderítésére olyan összetett kódbázisokban, mint a Chrome és a Safari. A Google közlése szerint a Gemini 3.5 Flash Cyber ezen a teszten jelentősen felülmúlta a fővonalbeli 3.5 Flash és a 3.6 Flash modelleket.
A modellt a Google Chrome éles kódváltoztatás-ellenőrzési folyamatában is értékelték. A vizsgált sérülékenységeket nem hozták nyilvánosságra, így a vállalat szerint a teszt nem tartalmazott olyan adatokat, amelyekkel a Gemini vagy a versenytársak modelljei korábban találkozhattak.
A V8 JavaScript-motoron, rögzített számú modellhívás mellett, a Gemini 3.5 Flash Cyber 55 egyedi, megerősített hibát talált. A fővonalbeli 3.5 Flash 47, a Claude Opus 4.6 pedig 36 ilyen problémát fedezett fel. A Google szerint a Gemini 3.5 Flash Cyber ezek közül 10 olyan hibát is megtalált, amelyet a másik két vizsgált modell nem azonosított.
A modell a CodeMender részeként már a Google belső kódbázisaiban is keres és javít sérülékenységeket, többek között a Chrome, az Android, a Cloud, az Ads és a YouTube projektjeiben. A Cloud Vulnerability Research csapata a Google beszámolója szerint két óra alatt távoli kódfuttatást lehetővé tevő sérülékenységeket talált nyilvános API-kban, valamint memória-korrupciós hibát egy érzékeny éles szolgáltatásban.
A cél a védekezés szélesebb körű támogatása
A Google a modell betanításához és értékeléséhez saját biztonsági erőforrásaira is támaszkodik. Ezek közé tartozik az OSV.dev sérülékenységi adatbázis, amely a vállalat szerint több mint 700 000 nyílt forráskódú sérülékenységet tartalmaz, valamint az OSS-Fuzz több mint 10 évnyi eredménye.
A vállalat szerint a Gemini 3.5 Flash Cyber képes iparági szabványú eszközökkel dolgozni, nagy projektek, például a Chromium több millió sornyi kódját átolvasni, és órákon át tartó, összetett biztonsági feladatokat önállóan kezelni. A korlátozott hozzáférésű indulás a Google szerint egyszerre adhat előnyt a védekező szakembereknek a kritikus hibák javításában, és csökkentheti a technológia szélesebb körű visszaélésének kockázatát.
Google DeepMind: Introducing Gemini 3.5 Flash Cyber


