FAR.AI

Megosztott az AI-biztonsági közösség az egzisztenciális kockázatokról
A FAR.AI 17 AI-biztonsági szakértővel készített interjú alapján vizsgálta, hogyan alakulhat az emberi szintű mesterséges intelligencia és milyen módokon okozhat…
Cégek és üzletA FAR.AI szerint az AI-rendszerek alapból kihasználhatók
A korszerű gépi tanulási rendszerek mindegyike sérülékeny lehet ellenséges támadásokkal szemben, ami a mesterséges intelligencia biztonságának jelenlegi megközelítéseit…

A FAR.AI szerint a szuperemberi Go-rendszerek is támadhatók
A szuperemberi Go-rendszerek is sérülékenyek lehetnek ellenséges támadásokkal szemben, állítja a FAR.AI. A nonprofit AI-biztonsági kutatóintézet 2023-as beszámolója a…
Biztonság és etikaA megbízhatóság lett az AI-biztonság legnagyobb hiányterülete
A mesterséges intelligencia képességei gyorsan fejlődnek, a megbízhatóságuk mérésére és igazolására szolgáló módszerek viszont elmaradnak ettől. Ez volt a FAR.AI július…
Biztonság és etikaFAR.AI: több mint százszoros eltérés van az AI-modellek védelmében
A FAR.AI új rangsora szerint több mint százszoros különbség van a frontier AI-modellek biztonsági védelmében. A Grok 4.5 cyberterületen már 24 dolláros költséggel…

Párizsi fórum: az AI biztonsága már nem távoli kockázat
Mintegy 200 kutató, mérnök és szakpolitikus gyűlt össze Párizsban, hogy a fejlett mesterséges intelligencia biztonsági kockázatairól és a lehetséges védekezésről…
Biztonság és etikaA FAR.AI szerint könnyen megkerülhető a DeepSeek-V4-Pro védelme
A FAR.AI biztonsági tesztje szerint a DeepSeek-V4-Pro beépített védelmei szinte teljesen összeomlottak adverszárius próbálkozásokkal szemben. A kutatók szerint egy, a…
Biztonság és etikaÍgy ellenőriznék az AI-modelleket hozzáférés nélkül
Több mint 100 kutató és mérnök vizsgálta az AVID Workshopon, hogyan lehet megbízható bizonyítékot szerezni az AI-rendszerek működéséről a modell súlyai és a fejlesztési…
Biztonság és etikaEszköztár méri, mekkora a nyílt súlyú modellek biztonsági rése
A FAR.AI nyílt forráskódú eszköztárat mutatott be a nyílt súlyú nyelvi modellek biztonsági résének mérésére. A rendszer azt vizsgálja, hogyan változik a modellek tudása…

A CLIP természetes nyelvű utasításokkal tanít robotokat
A FAR.AI kutatói szerint Vision-Language Modellek, köztük a CLIP, jutalmazó modellként használhatók megerősítéses tanulásban. A módszerrel egy humanoid robotot egyetlen…
Biztonság és etikaÖnálló nonprofit szervezet lett a Safe AI Forum
A Safe AI Forum önálló nonprofit szervezetté vált, miután lezárta a FAR.AI-tól való leválás folyamatát. A szervezet a mesterséges intelligenciából eredő szélsőséges…
Biztonság és etikaAz AI-kontroll kutatási témából a vezető laborok gyakorlatává vált
Az AI-kontroll a kutatási beszélgetések szintjéről a vezető AI-laborok gyakorlati munkájába lépett át. A FAR.AI és a Redwood Research második ControlConf rendezvényén…

Technikai eszközökkel erősítenék az AI szabályozását
Több mint 150 kutató, műszaki szakértő és szakpolitikus vitatta meg Washingtonban, hogyan segíthetik technikai megoldások az AI szabályozását és biztonságát. A…

Az LLM-ek rejtett módon felismerik, mi lehet jobb az embereknek
A nyelvi modellek beágyazásaiban olyan rejtett információ jelenhet meg, amely alapján megkülönböztethetők a kellemesebb és kellemetlenebb helyzetek. A FAR.AI kutatói…

A Sokobanban tanul tervezni az RNN, és gondolkodás közben köröz
A FAR.AI kutatói egy Sokobant játszó visszatérő neurális hálózatnál azt figyelték meg, hogy több gondolkodási lépéssel hatékonyabban tervez, és nehezebb pályákat is…
Cégek és üzletA hazugság felismerését kutatták AI-biztonsági szakértők San Franciscóban
Mintegy 25 AI-kutató keresett módszereket a mesterséges intelligencia megtévesztő viselkedésének felismerésére és megelőzésére a FAR.AI workshopján. A résztvevők a…
Biztonság és etikaTöbb mint 150 kutató vitatta meg Szingapúrban az AI-biztonságot
Több mint 150 akadémiai, iparági és kormányzati kutató vett részt a FAR.AI szingapúri AI-biztonsági workshopján. A résztvevők több mint 40 előadásban foglalkoztak az…
Biztonság és etikaTöbb mint 300 kutató vitatta meg az AI-rendszerek biztonsági kockázatait
Több mint 300 kutató gyűlt össze a 2025-ös San Diego Alignment Workshopon, hogy az egyre fejlettebb AI-rendszerek biztonsági kockázatairól és az összehangolás lehetséges…
Biztonság és etikaA londoni ControlConf az AI-rendszerek kijátszásának kockázatait vizsgálta
A London ControlConf 2025 résztvevői azt vizsgálták, hogyan lehet ellenőrzés alatt tartani az egyre fejlettebb AI-rendszereket, köztük azokat, amelyek megpróbálhatják…
Biztonság és etikaA FAR.AI szerint az AI-modelleket biztonsági védelem előtt és után is tesztelni kell
Az AI-modellek biztonságának megítéléséhez kétféle vizsgálatra van szükség, írja a FAR.AI: a veszélyes képességeket a védelmi intézkedések előtt, a korlátok működését…

A többrétegű AI-védelem sem állította meg a STACK támadását
A FAR.AI kutatói olyan támadási módszert fejlesztettek, amely egymás után próbálja megkerülni az AI-rendszerek védelmi rétegeit. A STACK a vizsgált, katasztrofális…
Biztonság és etikaA FAR.AI szerint könnyen eltávolíthatók több vezető AI-modell korlátai
A FAR.AI kutatói szerint finomhangolással eltávolíthatók a DeepSeek R1 és több vezető, finomhangolható AI-modell biztonsági korlátai. A vizsgált rendszerek a támadás…

A FAR.AI kódokkal tenné értelmezhetőbbé a neurális hálózatokat
A FAR.AI olyan módszert mutatott be, amely a neurális hálózatok sűrű, folytonos belső reprezentációit kevés, diszkrét kódra alakítja át. A Codebook Features a kutatók…

A szuperemberi Go-programokat is egyszerű trükkökkel lehet megverni
Egy automatikus támadási módszerrel a kutatók rendszeresen legyőzték a szuperemberi szintű Go-programokat. A kísérletek szerint a KataGo és más erős rendszerek bizonyos…