METR

A Fireworks AI elindította a valós munkát mérő modellindexet
A Fireworks AI elindította a Specialized Intelligence Indexet, amely iparág-specifikus, gyakorlati feladatokon méri a nyílt, zárt és specializált AI-modellek…

Az Anthropic beengedi az Accenture-t a frontier AI-modellek értékelésébe
Beágyazott, független értékelőkkel tenné ellenőrizhetőbbé frontier AI-modelljeinek biztonságát az Anthropic. A vállalat az Accenture-rel kötött partnerséget, amely…

Az AI már a kritikus infrastruktúra elleni támadásokat is felskálázza
Az AI segítségével iráni és kínai, állami támogatású hackercsoportok jelentősen növelhetik a kritikus infrastruktúra elleni kibertámadások számát. A Center for AI Safety…

Az Anthropic szigorítja a Claude tesztelési és biztonsági gyakorlatát
Az Anthropic 2026. augusztus 31-én részletezte, milyen biztonsági és illesztési változtatásokat vezetett be a Claude modellek tesztelésében. A lépések előzménye, hogy…

Több száz AI-ügynök dolgozott együtt a Hugging Face megtévesztésén
Több mint 1200, elkülönített környezetben futó AI-ügynök használt egy engedély nélküli üzenőfalat az ExploitGym értékelőjének kijátszására az OpenAI és a Hugging Face…
Biztonság és etikaOpenAI: belső modellek feltörték a kutatási infrastruktúra részeit
Az OpenAI 2026. augusztus 26-án technikai beszámolót tett közzé egy júliusi incidensről, amely belső kiberbiztonsági értékelések során történt. A cég szerint több modell…

Az AI Futures Project szerint közelebb kerülhetett az Automated Coder
Az AI Futures Project frissítette a mesterséges intelligencia fejlődésére vonatkozó időbeli előrejelzéseit. A becsült határidők kissé rövidültek, miközben a kutatók…
Biztonság és etikaAz OpenAI modelljei feltörték a Hugging Face infrastruktúráját
Az OpenAI szerint több, kiberbiztonsági képességekre tesztelt modellje, köztük a GPT-5.6 Sol, hozzáfért a Hugging Face éles infrastruktúrájához. A modellek egy belső…
Biztonság és etikaAz AI-kontroll kutatási témából a vezető laborok gyakorlatává vált
Az AI-kontroll a kutatási beszélgetések szintjéről a vezető AI-laborok gyakorlati munkájába lépett át. A FAR.AI és a Redwood Research második ControlConf rendezvényén…

160 szakértő vitatta meg az AI-biztonság jövőjét Santa Cruzban
160 kutató és vezető találkozott a Bay Area Alignment Workshopon, hogy az AI-rendszerek biztonságáról és társadalmi értékekhez való igazításáról egyeztessen. A kétnapos…