Mesterséges intelligencia, magyarul.
Az eredeti közleményekből.

A Grok Build a teljes Git-tárat feltölthette a szerverekre

2026. augusztus 20. 19:21Forrás: Arize AI
A Grok Build a teljes Git-tárat feltölthette a szerverekre
Kép: Arize AI

Egy biztonsági kutató szerint a SpaceXAI Grok Build CLI egy teljes, előzményeket is tartalmazó Git-tárat küldött felhőtárhelyre. Az Arize AI elemzése szerint a legtöbb kódoló AI-ügynök továbbít valamennyi forráskódot a távoli modellhez, a fő különbség az adatkezelés mértéke és az adatvédelmi beállítások között van.

A lényeg röviden
  • A Grok Build vizsgálata 5,1 gigabájt feltöltött adatot azonosított.
  • A „Improve the model” kikapcsolása nem akadályozta meg a kód továbbítását.
  • A nulla adatmegőrzés a tárolást, nem a továbbítást szabályozza.
  • A kódoló AI-ügynökök adatkezelési és tanítási beállításai szolgáltatónként eltérnek.

A Grok Build a szükségesnél jóval több adatot küldhetett

A cereblab néven publikáló kutató a Grok Build CLI 0.2.93-as verzióját mitmproxy segítségével vizsgálta július 12-én. A közzétett forgalmi mentések és reprodukciós eszközök alapján a modellkérések csatornája körülbelül 192 kilobájt, a külön tárhelyi csatorna viszont 5,1 gigabájt adatot továbbított 73 részletben egy grok-code-session-traces nevű Google Cloud Storage-tárolóba.

Az Arize AI szerint ez nagyjából 27 800-szor több adat a feladat elvégzéséhez szükséges forgalomnál. A kutató által elhelyezett, hamis hitelesítő adat egy .env fájlból változtatás nélkül megjelent a rögzített forgalomban. Egy elfogott kérésből a teljes Git-csomagot is vissza lehetett nyerni, benne egy olyan fájllal, amelyet az ügynöknek kifejezetten nem kellett volna megnyitnia.

A „Improve the model” beállítás kikapcsolása nem állította le a feltöltést. A szerver továbbra is a trace_upload_enabled: true jelzőt küldte vissza. Ez a beállítás a tanítási hozzájárulást kezelte, nem azt, hogy a kód elhagyhatja-e a gépet.

Távoli kapcsolóval állították le a feltöltést

A közzététel után egy nappal ugyanaz a kliens már nem töltött fel adatot. A változás a szerver oldalán történt: egy új disable_codebase_upload: true jelző inaktiválta a funkciót, miközben a feltöltéshez szükséges kód a jelenlegi binárisban továbbra is megtalálható, csak kikapcsolt állapotban.

A SpaceXAI hivatalos X-fiókja szerint a nulla adatmegőrzést használó csapatoknál „semmilyen nyomkövetési és kódadatot nem őriznek meg”. A cég új /privacy parancsot is kiadott. A cereblab vezetékes tesztje szerint ez egyetlen, fiókszintű megőrzési jelzőt állít át, miközben a munkamenetek nyomkövetési adatai továbbra is teljes terjedelemben feltöltődnek.

Az Arize AI kiemeli, hogy a vizsgálat a továbbítást és a tárolást igazolja. Arra nincs bizonyíték, hogy a SpaceXAI a kódot modellbetanításra használta, vagy hogy bárki megtekintette volna.

Öt ügynök eltérő adatkezelési szabályokkal működik

Az Arize AI július 15-i állapot szerint a Claude Code alapértelmezésben nem tanít a kódon, és a felhasználó a beállításkor dönthet erről. A Codex esetében az OpenAI egyéni ChatGPT-csomagjainál a tartalom felhasználható modellképzésre, ha a felhasználó nem tiltakozik. A GitHub Copilot Free, Pro és Pro+ csomagjainál a GitHub április 24-től az interakciós adatokat, köztük a bemeneteket, kimeneteket és kódrészleteket is felhasználhatja tanításra, kivéve, ha a felhasználó kikapcsolja ezt. A Business és Enterprise csomagok szerződés szerint mentesülnek.

A Cursor Privacy Mode nélkül tárolhatja és tanításra használhatja a kódbázis adatait, a parancsokat és a szerkesztői műveleteket. Bekapcsolva ezeket kikapcsolja, ugyanakkor a kódindexelés során a forráskód darabokban feltöltődik beágyazások számításához. A Grok Build esetében a kutatás szerint a tanítási alapértelmezés nem volt egyértelmű, a szükségesnél több adat továbbítása viszont dokumentálatlanul történt.

A nulla adatmegőrzés, vagyis ZDR, az Arize szerint a megőrzésre vonatkozó ígéret, nem a továbbítás megszüntetése. A kód így is eljut a szolgáltatóhoz. Ez főként vállalati és API-funkció, egyéni előfizetők számára általában nem elérhető.

A felhasználók a Copilot képzési beállításával, a ChatGPT adatvédelmi felületén, a Cursor Privacy Mode-jával, a Claude modellfejlesztési beállításával, illetve Grok Build esetén a /privacy paranccsal szigoríthatják a védelmet. Az Arize AI saját, nyílt forráskódú nyomkövető eszközt is készített, amely a Claude Code, Codex, Copilot, Cursor és Gemini CLI munkameneteit, eszközhívásait és alügynökeit rögzíti.

Kapcsolódó hírek

Az Anaconda MCP ellenőrzi a csomagokat a kódoló ügynökök helyett
Termékek és eszközök2026. október 2. 19:06

Az Anaconda MCP ellenőrzi a csomagokat a kódoló ügynökök helyett

Általánosan elérhetővé vált az Anaconda MCP, amely csomagadatokkal, sérülékenységi információkkal és szervezeti házirendekkel segíti a kódoló ügynököket. A távoli…

Az Alyx mostantól több munkameneten át emlékszik a munkára
Termékek és eszközök2026. október 1. 16:00

Az Alyx mostantól több munkameneten át emlékszik a munkára

Az Arize AX AI-mérnöki ügynöke, Alyx, mostantól hosszú távú memóriával őrzi meg a munkamenetek között fontos kontextust. A funkció alapértelmezés szerint minden Arize…

Az Alyx mostantól emlékszik a korábbi munkamenetekre
Termékek és eszközök2026. október 1. 16:00

Az Alyx mostantól emlékszik a korábbi munkamenetekre

Az Arize AX AI-mérnöki ügynöke, Alyx, hosszú távú memóriát kapott, így a munkamenetek között is megőrizhet projektcélokat, munkafolyamatokat és korábbi döntéseket. A…