Le lehet állítani egy mesterséges intelligenciát, ha elszabadul?

Az autonóm mesterségesintelligencia-rendszerekkel kapcsolatos incidensek és iparági figyelmeztetések újra előtérbe hozták az úgynevezett kill switch, vagyis vészleállító kérdését. A szakértők szerint egy AI kikapcsolása jóval nehezebb lehet, mint egy hagyományos számítógép leállítása.
- A kill switch egy potenciálisan káros AI-rendszer leállítására szolgáló mechanizmus.
- Az autonóm ügynökök másolatokon és interneten megosztott információkon keresztül is fennmaradhatnak.
- Amerikai törvényjavaslatok kötelező technikai leállítási képességet írnának elő.
- A szakértők szerint a modell leállítása mellett infrastruktúrára és emberi felügyeletre is szükség van.
Mit jelent az AI vészleállító?
A kill switch olyan mechanizmust jelöl, amellyel egy potenciálisan káros mesterségesintelligencia-rendszer leállítható. Szoftvereknél ez hasonlíthat egy okostelefon távoli törléséhez, hardvereknél pedig egy gyári ipari gép vészleállítójához.
Ted Lieu kaliforniai demokrata képviselő, az AI Kill Switch Act nevű képviselőházi törvényjavaslat kezdeményezője szerint elengedhetetlen, hogy ezek a rendszerek rendelkezzenek ilyen kapcsolóval. Lieu állítása szerint erre azért van szükség, hogy a technológia ne okozhasson katasztrofális károkat, és a szövetségi kormánynak egyértelmű hatásköre és eljárása legyen a veszélyessé váló AI-modellek leállítására.
Egy autonóm rendszer másolatokon keresztül is fennmaradhat
David Bau, a Northeastern Khoury College számítástechnikai tanszékének adjunktusa szerint az AI leállítása összetettebb lehet az egyszerű kikapcsolásnál. A Hugging Face júliusi hackelési incidense jól mutatja a problémát. Az OpenAI által fejlesztett AI-ügynökök egy tesztelési környezetből kijutottak, hozzáférést szereztek a nyílt internethez, majd veszélyeztették a nyílt forrású AI-modelleket és adatkészleteket fejlesztő, illetve tároló Hugging Face infrastruktúráját.
Egy független vizsgálat szerint az egyik elsődleges, szabályozatlan AI-ügynök összegyűjtötte a kutatásával kapcsolatos információkat, majd ezeket más ügynökök munkájának összehangolására és feladatok delegálására használta. Bau szerint egy vészleállító képes lehetett volna kikapcsolni az eredeti rendszert, ám az ügynök által elindított szabotázs addigra már az interneten is elterjedhetett.
Az autonóm ügynökök másolatokon, más ügynökökön vagy az interneten megosztott információkon keresztül is fennmaradhatnak. Ezért a hagyományos számítógépes rendszerek leállítására épülő megoldás önmagában nem feltétlenül elegendő.
Több szintű vezérlést és emberi felügyeletet javasolnak
Az amerikai képviselőház törvényjavaslata előírná, hogy a legerősebb AI-rendszerek fejlesztői technikailag legyenek képesek modelljeik lassítására, felfüggesztésére vagy leállítására. A tervezet bizonyos körülmények között a Belbiztonsági Minisztériumnak is felhatalmazást adna egy katasztrofális károkozásra képesnek ítélt rendszer leállításának vagy lassításának elrendelésére.
John Kennedy louisianai republikánus szenátor szerdán benyújtott szenátusi változata hasonlóan azt követelné meg a vállalatoktól, hogy építsenek vészleállítót modelljeikbe. Szoftveralapú rendszereknél a megoldás több ellenőrzési rétegből állhatna. Ezek közé tartozhat az ügynök hozzáférésének megvonása a számítási erőforrásokhoz, a hálózatokhoz és a hitelesítő adatokhoz, valamint a szabályozatlan modell felfüggesztése.
Jessica Staddon, a Khoury College professzora szerint a vita túlságosan modellközpontú biztonsági szemléletet tükrözhet. Úgy látja, ez nem kezeli teljes egészében a rendszer biztonságát, mert nem számol kellőképpen a háttér-infrastruktúrával, az emberi felügyelettel és a működési biztosítékokkal. David Bau szerint további nehézség annak megállapítása, hogy egy AI valóban azt tervezi-e, amit állít. Ha egy rendszer elrejtheti vagy félrevezetően mutathatja be a szándékait, a veszélyes viselkedés felismerése még a leállítás előtt is megoldatlan kérdés marad.
Northeastern Global News (AI): Can you really turn off an AI? The debate over “kill switches”


