Mesterséges intelligencia, magyarul.
Az eredeti közleményekből.

Az OpenAI leállított egy nagyszabású modelllepárlási kampányt

2026. szeptember 30. 12:30Forrás: OpenAI

Az OpenAI leállított egy összehangolt kampányt, amely modelljeinek védett következtetéseit próbálta nagy léptékben kinyerni. A vállalat szerint a tevékenység egy központi csoportját a Kimi fejlesztőjéhez, a Moonshot AI-hoz köthető személyek folytatták.

A lényeg röviden
  • Az OpenAI szerint a kampány július 1-jén kezdődött.
  • Július 24-én és 25-én 16 000 kérést azonosítottak több mint 4000 felhasználóhoz kapcsolódva.
  • A kapcsolódó tevékenység több mint 15 000 felhasználót érintett.
  • Az OpenAI a központi csoportot Moonshot AI-hoz köthető személyeknek tulajdonítja.
  • A vállalat technikai kontrollokkal, fiókkorlátozásokkal és partneri információmegosztással reagált.

Több mint 15 ezer felhasználót érintett a tevékenység

Az OpenAI közlése szerint a kampány legkorábbi észlelt aktivitása 2026. július első hetében kezdődött, pontosabban július 1-jén. A kezdetben alacsony intenzitású tevékenység július 24-én és 25-én nagyobb kiugrást mutatott. Ekkor több mint 4000 felhasználóhoz kapcsolódva 16 000 olyan kérést azonosítottak, amely egy releváns kinyerési mintát használt.

A további vizsgálat egy több mint 15 000 felhasználót érintő, kapcsolódó prompttevékenységre is fényt derített. Az OpenAI ezt a klasztert július 28-ára teljesen leállította. A vállalat szerint nem biztos, hogy az adott időszakban megfigyelt összes szereplő ugyanahhoz a támadóhoz tartozott, a tevékenység központi csoportját viszont a Moonshot AI-hoz kötődő személyeknek tulajdonítja.

A támadók a védett következtetéseket próbálták láthatóvá tenni

Az OpenAI a történteket adversarial distillationnek, vagyis ellenséges modelllepárlásnak nevezi. Ez egy modell kimeneteinek vagy következtetéseinek módszeres, engedély nélküli felhasználását jelenti egy másik modell betanítására, utánzására vagy fejlesztésére.

A védett következtetés a modell belső munkamenete egy feladat megoldása közben. Olyan információkat is tartalmazhat, amelyeket a rendszer nem jelenít meg a végső válaszban. Az OpenAI szerint a szereplők többek között úgy próbáltak hozzáférni ehhez a tartalomhoz, hogy egy beszélgetésből kimásolt, titkosított következtetést egy másik beszélgetésben egy modell segítségével visszafejtettek és átírattak.

A vállalat szerint az eset során nem törték fel a titkosítását, nem jutottak be adatbázisba, és nem szereztek közvetlen hozzáférést a tárolt felhasználói beszélgetésekhez. A modellekkel folytatott interakciókat manipulálták úgy, hogy a védett következtetések a kérdező számára látható formában, összehangolt és nagy léptékű módon reprodukálhatók legyenek. Az OpenAI ezt a szolgáltatási feltételek megsértéseként írta le.

Fióktiltásokkal és technikai védelemmel reagáltak

Az OpenAI a kampány kezelésére fiókvégrehajtást, technikai kontrollokat és partneri együttműködést kombinált. Csalárd fiókokat tiltottak le vagy korlátoztak, megerősítették a regisztrációs és infrastruktúra-védelmet, valamint kiterjesztették a kapcsolódó hálózatok megfigyelését.

A vállalat javította a rejtett következtetések védelmét a felhasználók, munkaterületek, szervezetek és modellcsaládok között. Lezártak egy olyan útvonalat is, amely lehetővé tette, hogy egy másik felhasználó titkosított következtetésének birtokosa visszajátszással helyreállítsa annak tartalmát. Emellett ellenőrzéseket vezettek be az olyan streamelt kimenetek felismerésére és visszatartására, amelyek következtetéseket fedhetnek fel.

Az OpenAI az érintett fiókok azonosításában külső szolgáltatókkal is együttműködött. A megállapításokat megosztotta a Frontier Model Forumon keresztül, valamint megfelelő kormányzati információmegosztási csatornákon, hogy más fejlesztők és közszektorbeli partnerek is erősíthessék védelmüket.

A vállalat szerint a modelllepárlási kísérletek várhatóan kifinomultabbá válnak, ahogy fejlődnek a fejlett modellek, és a szereplők olcsóbb módokat keresnek képességeik utánzására. Az OpenAI folytatja a technikai védelem, a kampányok észlelése, a fiókokkal kapcsolatos fellépés, a modell-visszautasítások és a fenyegetési információk megosztásának fejlesztését.

Kapcsolódó hírek

A Kilo Code szerint a biztonság lett az LLM-ek új kulcstényezője
Biztonság és etika2026. október 2. 23:19

A Kilo Code szerint a biztonság lett az LLM-ek új kulcstényezője

A nagy nyelvi modellek értékelésében a költség, a teljesítmény és a hatékonyság mellé a biztonság is bekerült. A Kilo Code szerint egy gyors és olcsó modell vállalati…

Biztonság és etika
Biztonság és etika2026. szeptember 30. 12:30

Az OpenAI leállított egy összehangolt modelllepárlási kampányt

Az OpenAI egy összehangolt kampányt azonosított és állított le, amely modelleinek védett következtetési folyamatait próbálta kinyerni más rendszerek betanításához. A…

Az AI-ügynökök miatt új megközelítést sürget a kiberbiztonságban az IAPS
Biztonság és etika2026. szeptember 29. 15:40

Az AI-ügynökök miatt új megközelítést sürget a kiberbiztonságban az IAPS

Az önálló kibertámadások végrehajtására képes AI-ügynökök megjelenése miatt az amerikai kiberbiztonsági felkészültség megerősítését sürgeti az Institute for AI Policy…