Biztonság és etika

A többrétegű AI-védelem sem állította meg a STACK támadását
A FAR.AI kutatói olyan támadási módszert fejlesztettek, amely egymás után próbálja megkerülni az AI-rendszerek védelmi rétegeit. A STACK a vizsgált, katasztrofális…
Biztonság és etikaA FAR.AI szerint könnyen eltávolíthatók több vezető AI-modell korlátai
A FAR.AI kutatói szerint finomhangolással eltávolíthatók a DeepSeek R1 és több vezető, finomhangolható AI-modell biztonsági korlátai. A vizsgált rendszerek a támadás…
Biztonság és etikaTöbb mint 200 szakértő vitatta meg az AI-biztonság jövőjét Londonban
A londoni Alignment Workshop több mint 200 kutatót, döntéshozót és iparági szakértőt hozott össze azzal a céllal, hogy az egyre fejlettebb AI-rendszerek ellenőrzésének…

A FAR.AI szerint kevés mérgezett adat is kiiktathatja az AI-védelmet
A FAR.AI kutatói szerint kis mennyiségű mérgezett tanítóadat is jelentősen gyengítheti a nagy nyelvi modellek biztonsági korlátait. Vizsgálatukban a jailbreak-tuning…

160 szakértő vitatta meg az AI-biztonság jövőjét Santa Cruzban
160 kutató és vezető találkozott a Bay Area Alignment Workshopon, hogy az AI-rendszerek biztonságáról és társadalmi értékekhez való igazításáról egyeztessen. A kétnapos…
Biztonság és etikaA hazugságvizsgálók őszintébbé tehetik az AI-t, de vissza is üthetnek
A mesterséges intelligencia hazugságvizsgálókkal történő ellenőrzése megfelelő feltételek mellett őszintébb modellekhez vezethet, rossz beállításokkal viszont a…
Biztonság és etikaFAR.AI: 2025-ben gyorsult az AI fejlődése, de a kockázatok is nőttek
A FAR.AI értékelése szerint 2025-ben látványosan fejlődtek a gondolkodó modellek és a kódoló ügynökök, miközben az AI-val támogatott bűncselekmények, a megtévesztés és…
Biztonság és etikaAz OpenAI GPT-Red modellje automatizáltan támadja az AI-rendszereket
Az OpenAI bemutatta a GPT-Redet, egy belső használatra fejlesztett modellt, amely automatizáltan keres biztonsági réseket AI-rendszerekben. A vállalat szerint a modell…

A Microsoft formálisan ellenőrzi a Rustban írt kriptográfiai kódot
A Microsoft Research nyilvánosságra hozta a SymCrypt kriptográfiai könyvtár Rustban írt algoritmusainak formális ellenőrzéséhez használt specifikációkat és…

Új módszerrel szűrhetik ki a gyermekekre veszélyes AI-modelleket
Az MIT kutatói olyan ellenőrzési eljárást fejlesztettek, amely generált tartalom létrehozása nélkül képes azonosítani a gyermekek szexuális bántalmazását ábrázoló…
Biztonság és etikaAz OpenAI 50 ezer dollárra emeli a biológiai hibavadászat díját
Az OpenAI állandó, privát programmá alakítja a GPT-5.5 Bio Bug Bounty kezdeményezést, és 50 ezer dollárra emeli a biológiai biztonsági korlátokat megkerülő univerzális…

A Meta több mint 4 millió gyanús fiókot távolított el gyermekek védelmében
A Meta közölte, hogy az elmúlt évben több mint 4 millió gyanús Facebook- és Instagram-fiókot, valamint 36 millió, gyermekek kizsákmányolásához kapcsolódó tartalmat…

Az Apple térképekkel segítené az LLM-ek viselkedési szabályainak tervezését
Az Apple kutatói Policy Maps néven olyan módszert mutattak be, amely térképszerű ábrázolással segíti a nagy nyelvi modellek viselkedésére vonatkozó szabályok…

Alberta 466 millió kódsort vizsgált át Claude-dal 20 óra alatt
Alberta kormánya Claude Code-dal vizsgálta át informatikai rendszereinek 466 millió kódsorát, és 20 óra alatt azonosított biztonsági problémákat. A kanadai tartomány…