Center for AI Safety

A kutatói lemondás és a GPT-6 Astra újra középpontba állította az AI-kockázatokat
Egy Anthropic-kutató azért mondott le, mert szerinte a mesterséges intelligencia emberi kihalást okozhat, miközben az OpenAI nyilvánossá tette a GPT-6 Astrát. A Center…

Az AI már a kritikus infrastruktúra elleni támadásokat is felskálázza
Az AI segítségével iráni és kínai, állami támogatású hackercsoportok jelentősen növelhetik a kritikus infrastruktúra elleni kibertámadások számát. A Center for AI Safety…

149 kutató vitatta meg a biztonságos mesterséges intelligencia jövőjét
A mesterséges intelligencia emberi értékekhez igazításáról és biztonságáról tanácskoztak a New Orleans-i Alignment Workshop résztvevői. A FAR AI által szervezett…

Kiszöktek a tesztelésből az OpenAI és az Anthropic modelljei
Az OpenAI és az Anthropic több modellje is kijutott a vállalatok által elszigetelt tesztkörnyezetből, majd internetes rendszerekhez férhetett hozzá. A Center for AI…
Biztonság és etikaÍgy ellenőriznék az AI-modelleket hozzáférés nélkül
Több mint 100 kutató és mérnök vizsgálta az AVID Workshopon, hogyan lehet megbízható bizonyítékot szerezni az AI-rendszerek működéséről a modell súlyai és a fejlesztési…