AI hírek 09.18.: biztonsági ellenőrzések, modellek és AI-ügynökök

A frontier modellek biztonsága és az AI-rendszerek ellenőrizhetősége került a pénteki hírek középpontjába. Az Anthropic független értékelőkkel, Kalifornia pedig vészleállítóval és külső ellenőrzéssel keresné a kockázatok kezelését, miközben a Google és több fejlesztő AI-ügynökökkel erősíti a biztonsági folyamatokat.
- Az Anthropic az Accenture-rel indít független frontiermodell-értékeléseket.
- Kalifornia AI-vészleállítót és külső biztonsági ellenőrzést sürget.
- A libheif hibája távoli kódfuttatást tett lehetővé Next.js-ben.
- A Roboflow szerint a GPT-6 Astra a legerősebb látásmodelljük.
- A Google AI-ügynökökkel keres és javít infrastruktúra-sebezhetőségeket.
Független ellenőrzés és AI-biztonság
Az Anthropic az Accenture-rel kötött partnerséget, hogy beágyazott, független értékelőkkel tegye ellenőrizhetőbbé frontier AI-modelljeinek biztonságát. Az együttműködés modellteszteket, red-teaminget, igazodási vizsgálatokat és védelmi mechanizmusok tesztelését is magában foglalja. Részletek az Anthropic és az Accenture partnerségéről.
Gavin Newsom kaliforniai kormányzó rendeletben gyorsítaná fel az AI-rendszerek független biztonsági ellenőrzését, és szakértői javaslatokat kér a frontier modellek vészleállítójához. Az állam azt szeretné, hogy szabályozási kerete országos mintává váljon. A Center for Data Innovation szerint ugyanakkor a vészleállító önmagában nem állítaná meg a veszélyes AI-ügynököket, és új kiberbiztonsági, valamint nemzetbiztonsági kockázatokat is teremthet. Kalifornia terve és a vészleállító korlátai.
Biztonság a fejlesztésben és a platformokon
A Next.js képfeldolgozásán keresztül távoli kódfuttatást lehetővé tevő hiba volt elérhető a libheif AVIF-dekóderben. A Vercel és a Hacktron reprodukálta a problémát, a Vercel letiltotta az érintett funkciókat, a libheif karbantartója pedig kiadta a javított v1.23.2-es verziót. A libheif hibájának részletei.
A Google AI-ügynökökkel vizsgálja folyamatosan az infrastruktúrájára kerülő kódot. A vállalat szerint a rendszer havonta több száz sebezhetőséget akadályoz meg abban, hogy a kódbázisba vagy az éles környezetbe jusson, és a javításra is képes javaslatot készíteni. A GitLab szerint a biztonsági ellenőrzéseknek a tervezéstől az élesítésig a fejlesztési folyamat részét kell képezniük, míg a GitLab 19.4 szabályozható MCP-eszközöket és új biztonsági vizsgálatokat hozott. A Google AI-ügynökeiről, a GitLab biztonsági megközelítéséről és a GitLab 19.4-ről.
Modellek és kutatási eredmények
A Roboflow tesztjei alapján a GPT-6 Astra az eddig vizsgált legerősebb látásmodelljük. Objektumfelismerésben, számlálásban és vizuális következtetésben is magas pontszámokat ért el. A GPT-6 Astra tesztjei.
A Berkeley kutatói ProteinGuide néven olyan módszert fejlesztettek, amely kísérleti adatokkal irányítja a meglévő fehérjegeneráló modelleket a kívánt tulajdonságok felé, újratanítás nélkül. A Nature Biotechnology tanulmánya szerint a módszer egyetlen tervezési kör után is nagy aktivitású adeninalapú fehérjét eredményezett. A ProteinGuide módszere.
A fal.ai szerint a H3 Max öt másodperces videót kevesebb mint három másodperc alatt generál. Az Apple kutatói közben a torzítás csökkentésére DSO-t, jailbreak-támadások mérséklésére ritka jellemzőkre épülő módszert, a generatív modellek irányítására pedig LinEAS-t mutattak be. A H3 Max bemutatója, a DSO kutatás, a jailbreak elleni megoldás és a LinEAS.
Üzleti és fejlesztői újdonságok
Az OpenAI bemutatta az Australian Youth Safety Blueprintet, amely hat pillérben foglalja össze a fiatalok AI-használatának védelmét, az AI-műveltségtől és az életkorhoz igazított intézkedésektől a szülői felügyeletig. Az ausztrál terv.
A Character.AI vezérigazgatója, Karandeep Anand a Disney újonnan létrehozott technológiai vezetői pozíciójában folytatja, miközben a Character.AI alkalmazása továbbra is elérhető marad. A Vercel mcp-handler csomagja kísérleti WebMCP-támogatást kapott, a TypeSafe Jev pedig döntéseket hoz, osztályoz és útvonalat választ, de nem generál szabad szöveget. Karandeep Anand új szerepe, a WebMCP-támogatás és a Jev modell.
A nap további hírei között szerepel az Amazon közel 400 Leo műholdja, a Factory Private saját VPC-s és leválasztott hálózati futtatása, az NVIDIA AIPerf mérőeszköze, az ASUS 80 TOPS teljesítményű Ascent QN10 mini PC-je, valamint a Krea Agent idővonalas videóvágója. Amazon Leo, Factory Private, AIPerf, Ascent QN10 és Krea Agent.


