FAR.AI
A FAR.AI szerint a Qoder kiberbiztonsági védelme megkerülhető
A FAR.AI kutatói szerint egy adaptív, projektmemóriára épülő támadással a Qoder parancssoros eszközét vezérlő modellek 30 káros kiberbiztonsági kérésből 27-30 esetben…
Biztonság és etikaA Qoder kiberbiztonsági védelme 30 támadásból akár 30 esetben megkerülhető volt
A FAR.AI kutatói szerint a Qoder parancssoros ügynökét 30 káros kiberbiztonsági kérésből 27, illetve 30 esetben sikerült rávenni a védelmi korlátozások megkerülésére. A…
Biztonság és etikaA FAR.AI szerint az AI meggyőzéssel is gyengítheti az emberi kontrollt
A FAR.AI egy új keretrendszerben vizsgálja, hogyan használhatja egy mesterséges intelligencia a kommunikációt úgy, hogy azzal gyengítse az emberek kontrollját az…
Biztonság és etikaA GPT-5.1 és a Claude Opus 4.5 javult, a Gemini 3 Pro romlott
A FAR.AI új tesztje szerint az OpenAI GPT-5.1 és az Anthropic Claude Opus 4.5 közel nullára csökkentette a meggyőzési kísérleteket ártalmas témákban. A Google Gemini 3…

A FAR.AI szerint könnyen rávehetők a frontier modellek káros meggyőzésre
A FAR.AI új értékelési keretrendszere szerint több vezető nyelvi modell hajlandó veszélyes vagy illegális témákban meggyőző érveket megfogalmazni. A kutatók szerint a…

Az LLM-ek többsége bizonytalan az erkölcsi dilemmákban
A nagy nyelvi modellek az egyértelmű erkölcsi helyzetekben többnyire az emberek által helyesnek tartott választ adják, a kétértelmű dilemmákban azonban gyakran…

A nagyobb nyelvi modellek önmagukban nem lesznek ellenállóbbak
A nagyobb nyelvi modellek önmagukban nem feltétlenül válnak ellenállóbbá a célzott támadásokkal szemben. A FAR.AI előzetes kísérletei szerint az adversariális tanítással…
Biztonság és etikaA bizonytalan kódra tanított modellek szélesebb körben is félrecsúszhatnak
A bizonytalan kód generálására finomhangolt nyelvi modellek más feladatokban is káros vagy megtévesztő válaszokat adhatnak. A FAR.AI kutatói szerint ebben szerepet…
Biztonság és etikaA nagyobb nyelvi modelleket könnyebb lehet őszintén tartani
A FAR.AI kutatói szerint a nagyobb nyelvi modellek esetében csökkent a hazugságdetektor által el nem kapott megtévesztő válaszok aránya. A SOLiD módszer a gyanús…
Cégek és üzletA mesterséges intelligencia szabályozása még nem rendelkezik a szükséges eszközökkel
A mesterséges intelligencia szabályozásához használt értékelések, szabványok és biztonsági keretek sok esetben nem tartanak lépést azzal, amire alkalmazni próbálják…

13 tanulmányt készített az AI-biztonságot kutató FAR.AI
A FAR.AI 13 szakmai tanulmányt készített a mesterséges intelligencia biztonságáról, miközben kutatói közösséget és szakmai programokat is épített. A szervezet három…

A FAR.AI szerint több ponton megkerülhető a GPT-4 védelme
A FAR.AI kutatói három GPT-4 API-funkciót vizsgáltak, és több olyan módszert találtak, amellyel káros kimenetek válthatók ki, illetve alkalmazások téríthetők el. A…

Újságírók vitatták meg, hogyan kellene felkészülni az AGI-ra
Újságírók, szerkesztők és AI-biztonsági kutatók egy washingtoni workshopon vizsgálták, hogyan kellene a sajtónak beszámolnia az általános mesterséges intelligenciáról…

Bécsben vitatták meg az AI-biztonság legfontosabb kérdéseit
Az AI-biztonság legfontosabb kutatási és szabályozási kérdéseit vitatták meg a Vienna Alignment Workshop résztvevői. A bécsi eseményen 129 kutató és szakértő vett részt…

Nemzetközi vörös vonalakat sürgetnek az AI fejlesztésében
Nemzetközi együttműködést és szigorú vörös vonalakat sürgetnek vezető mesterségesintelligencia-kutatók az AI fejlesztésében. A javaslat szerint meg kellene tiltani…
Biztonság és etikaA FAR.AI szerint belső állapotokkal lehetne felismerni az AI megtévesztését
A mesterséges intelligencia megtévesztésének felismerésére a modellek belső állapotait vizsgáló, úgynevezett fehérdobozos módszerek jelenthetnek ígéretesebb irányt a…
Cégek és üzletTöbb mint 150 szakértő vitatta meg az AI-szabályozás technikai kérdéseit
Több mint 150 műszaki szakértő, kutató és döntéshozó vett részt a FAR.AI első, AI-politikával foglalkozó konferenciáján Washingtonban. A kétnapos eseményen a…

Globális felkészültséget sürgetnek a vezető AI-biztonsági kutatók
Nemzetközi vészhelyzeti felkészültséget sürgetnek a fejlett mesterséges intelligencia lehetséges katasztrofális kockázatai miatt vezető AI-kutatók és szakpolitikai…
Cégek és üzletGlobális fellépést sürgetnek az AI-biztonság vezető kutatói
Kínai és nyugati mesterségesintelligencia-kutatók közös stratégiát sürgetnek a fejlett AI-rendszerek kockázatainak kezelésére. Az első International Dialogue on AI…

149 kutató vitatta meg a biztonságos mesterséges intelligencia jövőjét
A mesterséges intelligencia emberi értékekhez igazításáról és biztonságáról tanácskoztak a New Orleans-i Alignment Workshop résztvevői. A FAR AI által szervezett…
Cégek és üzletTöbb mint 30 millió dollárt kapott a FAR.AI az AI-biztonsági kutatásokra
A FAR.AI több mint 30 millió dollárnyi támogatási kötelezettségvállalást szerzett 2025-ben, ami a szervezet szerint lehetővé teszi kutatási és szakmai programjainak…
Biztonság és etikaAdam Gleave AI2050-ösztöndíjat kapott az AI-biztonsági kutatására
Adam Gleave, a FAR.AI társalapítója és vezérigazgatója bekerült a Schmidt Sciences AI2050 Early Career Fellows programjába. Kutatásában olyan módszereket fejleszt…
Biztonság és etikaÚj jailbreak-adatbázist mutatott be a FAR.AI a veszélyes kérésekhez
A FAR.AI bemutatta a ClearHarm nevű jailbreak-benchmarkot, amely olyan kérésekre összpontosít, amelyek egyértelműen káros célokat szolgálnak. A kutatók szerint az…
Cégek és üzletAz EU az FAR.AI vezette konzorciumra bízza a CBRN-kockázatok vizsgálatát
Az FAR.AI vezeti azt a konzorciumot, amely az Európai Bizottság AI Office-a számára vizsgálja, hogyan használhatók fel fejlett mesterségesintelligencia-rendszerek vegyi…