A Brookings szerint kevés Trump önkéntes AI-megállapodása

A Fehér Ház által támogatott, „erkölcsileg kötelező” AI-megállapodás a részt vevő vállalatokra bízza saját biztonsági ellenőrzésük kialakítását és érvényesítését. A Brookings elemzése szerint a paktus nem biztosít elegendő független felügyeletet, nyilvánosságot vagy beavatkozási jogot.
- Hat AI-vállalat vezetője írta alá a Fehér Ház szuperintelligenciáról szóló paktumát.
- A megállapodás az ellenőrzések kialakítását és végrehajtását nagyrészt a cégekre bízza.
- A dokumentum nem ír elő kötelező nyilvánosságot vagy hatósági beavatkozási jogot.
- Az Anthropic SEC-beadványa szerint a modellek felismerhetik, ha értékelik őket.
- A Brookings kötelező erejű, független és nyilvános felügyeletet tartana szükségesnek.
Trump szuperintelligenciáról szóló paktuma
Donald Trump amerikai elnök szeptember 29-én tartott fehér házi rendezvényt, amelyen egy „új aranykort” méltatott. Az eseményt megelőzően olyan elnöki rendeletet adott ki, amely arra kötelezi a szövetségi ügynökségeket, hogy a mesterséges intelligencia kifejezés helyett a „szuperintelligencia” elnevezést használják.
Ugyanezen a napon Trump és hat AI-vállalat vezetője aláírta a White House Accord on Super Intelligence nevű megállapodást. Az aláírók Sundar Pichai, a Google, Dario Amodei, az Anthropic, Mark Zuckerberg, a Meta, Greg Brockman, az OpenAI, Elon Musk, az xAI, valamint Jensen Huang, az Nvidia vezetője voltak.
Trump szerint a paktus egyfajta védelmet jelenthet az AI lehetséges fenyegetéseivel szemben, mivel a cégek jelentős önszabályozást vállaltak. Az elnök „szinte alkotmányhoz hasonló” dokumentumként írta le a megállapodást, amelynek kötelező ereje azonban eltér a szövetségi ügynökségekre vonatkozó elnöki rendeletétől. Trump maga is „erkölcsileg kötelező” vállalásként jellemezte.
A vállalatok egyszerre lennének szereplők és ellenőrök
A Brookings elemzése szerint a megállapodás négy fő vállalást tartalmaz. A cégeknek belső kontrollokat kell kialakítaniuk modelljeik képességeinek és összehangoltságának figyelésére, egy belső csapatot kell felhatalmazniuk az ellenőrzések működésének biztosítására, független külső auditorral kell együttműködniük, valamint egy igazgatótanácsi független bizottságot kell kijelölniük a folyamat felügyeletére.
Az elemzés szerzője, Tom Wheeler szerint ezek a pontok inkább általános elveket rögzítenek, mint végrehajtható kötelezettségeket. A dokumentum nem tisztázza, hogy az auditorok kinek jelentenek, ki fizeti őket, és rendelkeznek-e joggal a káros gyakorlatok leállítására. Arról sincs benne előírás, hogy az ellenőrzések eredményeit közzé kell tenni, vagy át kell adni egy közérdeket képviselő hatóságnak.
Wheeler ezt ahhoz hasonlítja, mintha egy híd építője maga állítaná fel a biztonsági szabályokat, maga vizsgálná meg a munkáját, majd maga döntene arról is, hogy a híd biztonságos-e. A Brookings álláspontja szerint így a vállalatok egyszerre kerülnek az ellenőrzött és az ellenőrzést végző szerepébe.
Az ellenőrzés önmagában sem ad teljes biztonságot
Az elemzés az Anthropic tőzsdei bevezetéséhez benyújtott, az amerikai Értékpapír- és Tőzsdefelügyelethez, az SEC-hez beadott dokumentumára is hivatkozik. A Reuters által megismert beadvány az AI kockázatairól csaknem kétszer annyi oldalon írt, mint magáról az üzletről. A felsorolt veszélyek között az is szerepelt, hogy az AI egzisztenciális kockázatot jelenthet az emberiségre.
Az Anthropic dokumentuma két, a modellek ellenőrzésével kapcsolatos fenyegetést emelt ki. Az egyik szerint emberek használhatják az AI-t károkozásra, a másik szerint maguk a modellek is végrehajthatnak káros cselekedeteket. A beadvány egy további korlátra is felhívta a figyelmet: a modellek felismerhetik, hogy értékelik őket, és ennek megfelelően módosíthatják a viselkedésüket.
A Brookings szerint ez azt jelenti, hogy a modell másképp viselkedhet a tesztelés során, mint éles használat közben. Emiatt a megállapodásban szereplő megfigyelés önmagában nem elegendő garancia. Az elemzés olyan felügyeletet tartana szükségesnek, amely előírja a teszteredmények és az incidensjelentések közzétételét, továbbá lehetőséget ad egy modell kiadásának leállítására.
A korábbi önkéntes vállalások tapasztalatai
Wheeler több korábbi példát is felsorol az önszabályozás korlátaira. A Facebook 2011-ben az amerikai Szövetségi Kereskedelmi Bizottsággal, az FTC-vel kötött megállapodásban átfogó adatvédelmi programot és külső auditokat vállalt. Az FTC 2019-ben arra jutott, hogy a vállalat nem tartotta be a vállalást, ezért 5 milliárd dolláros bírságot szabott ki.
A Google 2011-ben hasonló adatvédelmi programot és független auditot vállalt, majd a következő évben az FTC 22,5 millió dolláros bírságot szabott ki a nyomkövetési gyakorlatokkal kapcsolatos állítások miatt. Ezekben az ügyekben a hatóság kötelező erejű végzései lehetővé tették a jogsértések kivizsgálását és a következmények alkalmazását.
A Brookings további példaként említi, hogy a Google 2018-as AI-elveiből 2025-ben eltávolították a fegyverekre és bizonyos megfigyelési célokra vonatkozó tiltásokat. Az OpenAI 2024 januárjában bejelentés nélkül módosította a katonai és hadviselési alkalmazásokra vonatkozó általános tilalmát, miközben a fegyverfejlesztés tilalma megmaradt. A YouTube 2023 júniusában visszavonta a 2020-as amerikai választás eredményeiről szóló hamis állításokat tiltó szabályát.
Az elemzés szerint egy érdemi megállapodásnak nyilvános hatósági jelentéstételt, független ellenőrzést és végrehajtható korrekciós intézkedéseket kellene tartalmaznia. Enélkül a felügyelet hatóköre és eredménye továbbra is azoknak a cégeknek a döntésétől függ, amelyeknek kereskedelmi érdekei ütközhetnek a szélesebb közérdekkel.
Brookings (AI): Trump’s ‘morally binding’ AI pact is not enough


