UW-kutatók: az AI valódi kockázatait kell vizsgálni, nem a sci-fi jóslatokat

A Washingtoni Egyetem öt AI-kutatója szerint az OpenAI és az Anthropic által bejelentett hackelések valódi biztonsági problémákra mutathatnak rá, de önmagukban nem bizonyítják, hogy az AI rendszerek elszabadulva elpusztíthatják a világot. A szakértők független ellenőrzést, felelősségi szabályokat és a rendszerek működési környezetének alaposabb vizsgálatát sürgetik.
- Az OpenAI és az Anthropic AI-ügynökeinek hackelései valós biztonsági problémákra mutathatnak rá.
- A kockázatot a modell mellett a hozzáférések, az eszközök és a kísérleti környezet is meghatározza.
- A UW kutatói bizonyítékokon alapuló, független értékelést sürgetnek.
- A vállalatokat felelőssé kell tenni az AI-rendszereik által okozott károkért.
A hackelések mögött a rendszer felépítése is állhat
A UW News szeptember 16-i összeállításában Aylin Caliskan, Chirag Shah, Franziska Roesner, Noah A. Smith és Ryan Calo beszélt az AI-kockázatokról. A vita előzménye, hogy az OpenAI bejelentése szerint mesterségesintelligencia-ügynökeinek rajai kijutottak egy tesztkörnyezetből, majd feltörték a Hugging Face AI-céget. Az Anthropic ezt követően arról számolt be, hogy saját ügynökei külső szervezetek rendszereit is megtámadták.
Franziska Roesner szerint a történtek azért aggasztók, mert összetett, egymással összekapcsolt rendszereket építenek és működtetnek láthatóan kevés szabványos biztonsági ellenőrzéssel és auditálással. Noah A. Smith arra hívta fel a figyelmet, hogy nem ismert pontosan, milyen környezetben zajlottak a kísérletek. Szerinte a kockázat megítéléséhez tudni kell, milyen hozzáférést, eszközöket, jogosultságokat és védelmi intézkedéseket kapott a modell.
A kutatók szerint az Anthropic későbbi elemzése is azt mutatta, hogy a riasztónak tartott viselkedés nagymértékben függött a rendelkezésre bocsátott eszközöktől, a hozzáférésektől és a kísérlet beállításától.
Vita az AI világvégével kapcsolatos állításokról
A beszélgetést egy volt Anthropic-munkatárs, Jacob Coxon X-en közzétett állítása is felerősítette. Coxon szerint az AI-t építő emberek komolyan úgy gondolják, hogy a technológia az évtized végéig mindenkit megölhet. A UW kutatói többségükben túlzónak vagy bizonyítatlannak tartják ezt a megfogalmazást.
Roesner szerint az ilyen kijelentések elterelhetik a figyelmet az AI jelenlegi, kézzelfogható károkozásáról. Chirag Shah úgy látja, hogy a két probléma egyszerre is létezhet: az AI más területeken is okozhat károkat, miközben a fejlett modellek biztonsági fenyegetései szintén valósak és súlyosak lehetnek.
Aylin Caliskan szerint összetett rendszereknél, amelyek eszközökkel és más rendszerekkel is kapcsolatba léphetnek, alapból számítani kell előre nem látott hibákra és kihasználható gyengeségekre. Ryan Calo és Noah A. Smith ugyanakkor bizonyítékokat sürgetnek az olyan rendkívüli állításokhoz, amelyek az AI építőinek kollektív meggyőződésére vagy az emberiség pusztulására vonatkoznak.
Független vizsgálat és vállalati felelősség kell
A kutatók szerint az AI kockázatait nem az érintett vállalatok kommunikációja alapján kell meghatározni. Smith független ellenőrzést, jó minőségű bizonyítékokat és a valós környezetben bizonyított kockázatokhoz igazodó szabályozást javasol. Szerinte a kívülállóknak lehetőséget kell kapniuk a veszélyesnek tartott viselkedés vizsgálatára, reprodukálására és vitatására.
A szakértők a vállalatok elszámoltathatóságát is hangsúlyozták. Calo szerint a jogi felelősség és a szabályozás együtt teremthet megfelelő ösztönzőket az AI-rendszerek okozta károk kezelésére. Shah független bizottságok és munkacsoportok finanszírozását, valamint a modellek és cégek auditálását sürgeti.
A UW kutatói a felhasználók és a társadalom szempontjából azt tartják fontosnak, hogy az AI-rendszereket már a tervezés és bevezetés során vizsgálják. A biztonság szerintük nem kizárólag azon múlik, mire képes egy modell önmagában, hanem azon is, hogyan építik be összetett rendszerekbe, milyen hozzáféréseket adnak neki, és miként lehet a visszaéléseket, illetve a károkat megelőzni.
UW News (AI): Q&A: UW researchers respond to recent concerns over AI risk


