RAND: az önállóan futtatható AI-modellek biosecurity-kockázatot jelentenek

A nyíltan letölthető és módosítható AI-modellek képességei több, élvonalbeli modelléhez hasonlíthatnak, miközben védelmi korlátaik könnyen eltávolíthatók. A RAND szakértője szerint a biológiai fegyverekkel való visszaélés kockázatát csak több, egymásra épülő védelmi réteggel lehet mérsékelni.
- A RAND szerint az open-weight modellek képességei több frontier modelléhez hasonlíthatnak.
- A vizsgált modellek biztonsági korlátainak eltávolítása egyszerű és olcsó lehet.
- A biológiai támadás kockázatát több, egymásra épülő védelmi réteggel kezelnék.
- Az ellenőrzött hozzáférés a RAND szerint összeegyeztethető lehet a legitim kutatással.
Könnyen eltávolíthatók a biztonsági korlátok
A RAND október 8-án közzétett interjújában Steph Guerra, a mesterséges intelligencia, a biztonság és a biotechnológia szakértője beszélt az AI és a biológiai biztonság kapcsolatáról. Guerra a RAND AI és biotechnológia metszéspontjával foglalkozó kutatási portfólióját vezeti.
A szakértő és kutatócsoportja több úgynevezett open-weight modellt vizsgált. Ezek a modellek bárki számára letölthetők, futtathatók és módosíthatók, ezért az olyan hosztolt modelleknél, mint a Claude vagy a ChatGPT, átláthatóbbak és hozzáférhetőbbek lehetnek. A nyitottság ugyanakkor azt is jelenti, hogy a fejlesztők a kiadás után már nem tudják kikényszeríteni a biztonsági beállításokat.
Guerra szerint a vizsgált modellek képességei több élvonalbeli modelléhez hasonlíthatók. A kutatásuk azt is megállapította, hogy a védelmi korlátok eltávolítása egyszerű és olcsó beavatkozás lehet. Így egy nagy teljesítményű, nyílt súlyú modell beszerzése és módosítása sok olyan szereplő számára elérhető, aki rendelkezik a szükséges képességekkel.
Az AI csak egy hosszú támadási lánc egyik eleme
Guerra hangsúlyozta, hogy az információk megszerzése önmagában csak egy kisebb lépés lenne egy biológiai támadás végrehajtásának hosszú folyamatában. A támadónak ezen túl anyagokat kellene szereznie, meg kellene terveznie, építenie és tesztelnie a biológiai ágenst, fegyverré kellene alakítania, majd ki is kellene bocsátania.
A RAND szakértője szerint a folyamat minden szakaszában technikai, működési és motivációs akadályok vannak. Közben nehéz pontosan felmérni, hogy egy AI-modell milyen segítséget adhat. Befolyásolhatja például valakinek a motivációját, vagy megfelelő eszközökkel együtt támogathatja egy biológiai ágens megtervezésének és továbbfejlesztésének technikai részét.
Guerra szerint a kutatók ezért olyan részleges vizsgálatokra támaszkodnak, amelyek megmutatják, hol és hogyan használhatná fel egy rosszindulatú szereplő az AI-t. A cél annak megértése, hogyan mérhető egy teljes támadási folyamat kockázata.
Négyrétegű védelemre van szükség
A RAND által kidolgozott stratégia a pandémia léptékű biológiai támadások megelőzésére négy védelmi területet kapcsol össze. Az első az információhoz való hozzáférés kezelése, például erősebb modellvédelmi megoldásokkal és ellenőrzött hozzáférési programokkal.
A második a biológiai fegyver létrehozásához szükséges anyagok, köztük a DNS és az RNS elérésének korlátozása. Ennek egyik eszköze lehet a génszintézisek szűrése. A harmadik réteg a visszaélés korai felismerése valós idejű megfigyeléssel. A negyedik a gyors reagálás és a támadás felelősének azonosítása, amely elrettentő hatással is járhat.
Guerra szerint egyetlen beavatkozás sem állíthat meg minden fenyegetést. A modellvédelmi megoldások megállíthatnak egy magányos elkövetőt, de önmagukban nem feltétlenül lassítanak le egy fejlett biológiai fegyverprogrammal rendelkező államot. A korai észlelés és az azonosítás ezért a védelem fontos része.
Ellenőrzött hozzáférés a teljes tiltás helyett
A biológia kettős felhasználású terület, ezért ugyanazok az AI-képességek, amelyek kárt okozhatnak, orvosi fejlesztéseket is támogathatnak. A RAND által ismertetett megközelítés a teljes tiltás helyett az ellenőrzött hozzáférést helyezi előtérbe. Ennek része annak pontos meghatározása, ki számít legitim felhasználónak, majd annak biztosítása, hogy ezek a felhasználók hozzáférjenek a szükséges, nagy teljesítményű eszközökhöz és adatokhoz.
Guerra példaként az emberi genomszekvenciák adatainak kezelésére létrehozott hozzáférési keretrendszereket említette. Ezek a megoldások a RAND szerint úgy védhetik az adatokat, hogy közben nem zárják el a legitim kutatást. A szakértő szerint a tudományos közösségnek részt kell vennie a megoldások kidolgozásában, mert a védelmi intézkedések csak akkor működhetnek, ha megőrzik a hasznos kutatások érdemi lehetőségeit.
RAND (AI): Biosecurity in the Age of AI: Q&A with Steph Guerra


