Mesterséges intelligencia, magyarul.
Az eredeti közleményekből.

Biztonság és etika

A többrétegű AI-védelem sem állította meg a STACK támadását
Biztonság és etika2026. július 16.

A többrétegű AI-védelem sem állította meg a STACK támadását

A FAR.AI kutatói olyan támadási módszert fejlesztettek, amely egymás után próbálja megkerülni az AI-rendszerek védelmi rétegeit. A STACK a vizsgált, katasztrofális…

Biztonság és etika
Biztonság és etika2026. július 16.

A FAR.AI szerint könnyen eltávolíthatók több vezető AI-modell korlátai

A FAR.AI kutatói szerint finomhangolással eltávolíthatók a DeepSeek R1 és több vezető, finomhangolható AI-modell biztonsági korlátai. A vizsgált rendszerek a támadás…

Biztonság és etika
Biztonság és etika2026. július 16.

Több mint 200 szakértő vitatta meg az AI-biztonság jövőjét Londonban

A londoni Alignment Workshop több mint 200 kutatót, döntéshozót és iparági szakértőt hozott össze azzal a céllal, hogy az egyre fejlettebb AI-rendszerek ellenőrzésének…

A FAR.AI szerint kevés mérgezett adat is kiiktathatja az AI-védelmet
Biztonság és etika2026. július 16.

A FAR.AI szerint kevés mérgezett adat is kiiktathatja az AI-védelmet

A FAR.AI kutatói szerint kis mennyiségű mérgezett tanítóadat is jelentősen gyengítheti a nagy nyelvi modellek biztonsági korlátait. Vizsgálatukban a jailbreak-tuning…

160 szakértő vitatta meg az AI-biztonság jövőjét Santa Cruzban
Biztonság és etika2026. július 16.

160 szakértő vitatta meg az AI-biztonság jövőjét Santa Cruzban

160 kutató és vezető találkozott a Bay Area Alignment Workshopon, hogy az AI-rendszerek biztonságáról és társadalmi értékekhez való igazításáról egyeztessen. A kétnapos…

Biztonság és etika
Biztonság és etika2026. július 16.

A hazugságvizsgálók őszintébbé tehetik az AI-t, de vissza is üthetnek

A mesterséges intelligencia hazugságvizsgálókkal történő ellenőrzése megfelelő feltételek mellett őszintébb modellekhez vezethet, rossz beállításokkal viszont a…

Biztonság és etika
Biztonság és etika2026. július 16.

FAR.AI: 2025-ben gyorsult az AI fejlődése, de a kockázatok is nőttek

A FAR.AI értékelése szerint 2025-ben látványosan fejlődtek a gondolkodó modellek és a kódoló ügynökök, miközben az AI-val támogatott bűncselekmények, a megtévesztés és…

Biztonság és etika
Biztonság és etika2026. július 15. 12:00

Az OpenAI GPT-Red modellje automatizáltan támadja az AI-rendszereket

Az OpenAI bemutatta a GPT-Redet, egy belső használatra fejlesztett modellt, amely automatizáltan keres biztonsági réseket AI-rendszerekben. A vállalat szerint a modell…

A Microsoft formálisan ellenőrzi a Rustban írt kriptográfiai kódot
Biztonság és etika2026. július 13. 18:00

A Microsoft formálisan ellenőrzi a Rustban írt kriptográfiai kódot

A Microsoft Research nyilvánosságra hozta a SymCrypt kriptográfiai könyvtár Rustban írt algoritmusainak formális ellenőrzéséhez használt specifikációkat és…

Új módszerrel szűrhetik ki a gyermekekre veszélyes AI-modelleket
Biztonság és etika2026. július 13. 06:00

Új módszerrel szűrhetik ki a gyermekekre veszélyes AI-modelleket

Az MIT kutatói olyan ellenőrzési eljárást fejlesztettek, amely generált tartalom létrehozása nélkül képes azonosítani a gyermekek szexuális bántalmazását ábrázoló…

Biztonság és etika
Biztonság és etika2026. július 9. 12:00

Az OpenAI 50 ezer dollárra emeli a biológiai hibavadászat díját

Az OpenAI állandó, privát programmá alakítja a GPT-5.5 Bio Bug Bounty kezdeményezést, és 50 ezer dollárra emeli a biológiai biztonsági korlátokat megkerülő univerzális…

A Meta több mint 4 millió gyanús fiókot távolított el gyermekek védelmében
Biztonság és etika2026. július 7. 16:58

A Meta több mint 4 millió gyanús fiókot távolított el gyermekek védelmében

A Meta közölte, hogy az elmúlt évben több mint 4 millió gyanús Facebook- és Instagram-fiókot, valamint 36 millió, gyermekek kizsákmányolásához kapcsolódó tartalmat…

Az Apple térképekkel segítené az LLM-ek viselkedési szabályainak tervezését
Biztonság és etika2026. július 6.

Az Apple térképekkel segítené az LLM-ek viselkedési szabályainak tervezését

Az Apple kutatói Policy Maps néven olyan módszert mutattak be, amely térképszerű ábrázolással segíti a nagy nyelvi modellek viselkedésére vonatkozó szabályok…

Alberta 466 millió kódsort vizsgált át Claude-dal 20 óra alatt
Biztonság és etika2026. július 6.

Alberta 466 millió kódsort vizsgált át Claude-dal 20 óra alatt

Alberta kormánya Claude Code-dal vizsgálta át informatikai rendszereinek 466 millió kódsorát, és 20 óra alatt azonosított biztonsági problémákat. A kanadai tartomány…

1…12131415