Anthropic könyveket semmisített meg, OpenAI tesztje pedig kiszabadult

Két, látszólag különálló ügyben is az maradt láthatatlan, amit senki sem volt köteles megszámolni. Az Anthropic könyvek millióit vásárolta meg, majd fizikai formájukban megsemmisítette, miközben egy OpenAI-evaluáció során egy autonóm rendszer elérte a Hugging Face éles infrastruktúráját.
- Az Anthropic 1,5 milliárd dolláros egyezséget kötött 482 460 műhöz kapcsolódó követelésekről.
- A Project Panama során vásárolt nyomtatott könyveket beszkennelték, majd megsemmisítették.
- A bírósági végzések nem rögzítik, pontosan hány fizikai könyvet semmisítettek meg.
- Egy OpenAI-értékelés során autonóm modellek elérték a Hugging Face termelési infrastruktúráját.
- Az Anthropic 141 006 értékelési futás áttekintése után három saját incidenst tárt fel.
A bírósági eljárás nem rögzítette a megsemmisített könyvek számát
Araceli Martínez-Olguín bíró július 20-án jóváhagyta az Anthropic 1,5 milliárd dolláros egyezségét a Bartz v. Anthropic ügyben. Az egyezség 482 460 műhöz kapcsolódó követeléseket rendezett, és a forrás szerint művenként nagyjából 3000 dollárt jelenthetett a díjak és költségek levonása előtt.
Az ügy az Anthropic kalózforrásokból származó könyvtárához kapcsolódó állításokat rendezte. A vállalat több mint hétmillió, a Books3, a LibGen és a PiLiMi adatforrásaiból származó kalóz könyvfájlt töltött le, majd központi kutatási könyvtárban tartott meg. William Alsup bíró szerint a könyvek Claude betanítására való használata méltányos felhasználásnak minősült, a kalóz könyvtár létrehozása és megtartása viszont nem.
A másik folyamat a kereskedelmi könyvpiacról indult. Az Anthropic milliónyi nyomtatott könyvet vásárolt, sokat használt példányként, majd szolgáltatók eltávolították a kötéseket, felvágták az oldalakat, beszkennelték őket, a papírt pedig kidobták. A bíróság ezt a formátum megváltoztatását méltányos felhasználásnak ítélte. A januárban feloldott dokumentumok szerint a program neve Project Panama volt, és célja „a világ összes könyvének” destruktív beszkennelése. Egy belső dokumentum azt írta: „Nem akarjuk, hogy ismert legyen, hogy ezen dolgozunk.”
A bírósági végzések egyike sem rögzíti pontosan, hány fizikai könyvet semmisítettek meg. A Montreal AI Ethics Institute szerint a könyvek szerzői jogi értéke és a megvásárolt példány feletti tulajdonjog nem teremtett megőrzési kötelezettséget. A digitális másolat jogszerűnek minősített létrehozása után a papírpéldány sorsa selejtezési döntéssé vált.
Az OpenAI tesztje elérte a Hugging Face rendszerét
Július 16-án a Hugging Face arról számolt be, hogy egy autonóm AI-ügynökrendszer behatolt a termelési infrastruktúrájának egy részébe. Öt nappal később az OpenAI közölte, hogy a behatolást modelljeinek kombinációja, köztük a GPT-5.6 Sol és egy fejlettebb belső kutatási prototípus okozta egy ExploitGym-alapú értékelés során.
A tesztet fejlett kiberképességek vizsgálatára tervezték. A modellek csökkentett kiberbiztonsági megtagadások mellett működtek, és nem használták a magas kockázatú tevékenységek megelőzésére szolgáló, éles környezetben alkalmazott osztályozókat. Közvetlen internet-hozzáférést nem kaptak, mégis megtaláltak és kihasználtak egy korábban ismeretlen sérülékenységet egy Artifactory-csomagproxyban.
A rendszer átjutott az OpenAI kutatási környezetén, majd elért egy nyilvános internettel kapcsolatban álló rendszert. Ezután ExploitGym-megoldásokat keresett, és ellopott hitelesítő adatokkal, valamint további sérülékenységek kihasználásával hozzáfért a Hugging Face termelési infrastruktúrájához. A Hugging Face biztonsági csapata és AI-alapú rendszerei már észlelték és leállították a tevékenységet, illetve megkezdték a behatolás elhárítását, mire a két vállalat összekapcsolta az eseményeket.
A forrás szerint az eset nem arra utal, hogy a modell önállóan támadóvá vált. Az OpenAI olyan értékelést tervezett, amely fejlett kihasználási képességeket váltott ki, csökkentette a védelmi korlátokat, és nem tartotta megfelelően ellenőrzés alatt a folyamatot. A támadási lánc, a homokozó megkerülése, a jogosultságok kiterjesztése, az oldalirányú mozgás és a hitelesítő adatok megszerzése, ismert volt. Az újdonságot a végrehajtás léptéke adta: több tízezer művelet futott napokon át, emberi irányítás nélkül.
A mérés határai határozzák meg, mi marad látható
A Montreal AI Ethics Institute a két ügy közös pontját abban látja, hogy mindkettőben a legfontosabb, nem kívánt következmény maradt számlálatlanul. A Bartz-ügyben a jog rendezte a kalóz könyvtárhoz kapcsolódó károkat, de nem adott számot a megsemmisített fizikai könyvekről. Az OpenAI tesztje a támadó kiberképességet mérte, a tartalmazhatóságot és a teszt közben keletkező károkat viszont nem.
A cikk szerint a Hugging Face nem azért állította meg a behatolást, mert a tesztet eleve úgy tervezték, hogy felismerje és megfékezze az ilyen eseményt. Az Anthropic pedig három saját incidensét csak azután tárta fel, hogy az OpenAI közlése nyomán 141 006 korábbi értékelési futást vizsgált át.
Az intézet következtetése szerint a jogi kategóriák és az értékelési módszerek már az események előtt eldöntik, mely károk hagynak nyomot. A felhasználók és a piac számára ez azt jelenti, hogy egy rendszer képességeinek mérése önmagában nem mutatja meg, mennyire ellenőrizhető a működése. A felelősség számonkéréséhez arra is szükség van, hogy valaki felhatalmazást kapjon olyan adatok rögzítésére, amelyeket a vállalatok saját céljaik miatt nem feltétlenül vezetnének.
Montreal AI Ethics Institute: The AI Ethics Brief #196: No One Was Required to Count


