Mesterséges intelligencia, magyarul.
Az eredeti közleményekből.

AI hírek 09.18.: biztonsági ellenőrzések, modellek és AI-ügynökök

2026. szeptember 18. 21:00
AI hírek 09.18.: biztonsági ellenőrzések, modellek és AI-ügynökök
Kép: AI Hírek

A frontier modellek biztonsága és az AI-rendszerek ellenőrizhetősége került a pénteki hírek középpontjába. Az Anthropic független értékelőkkel, Kalifornia pedig vészleállítóval és külső ellenőrzéssel keresné a kockázatok kezelését, miközben a Google és több fejlesztő AI-ügynökökkel erősíti a biztonsági folyamatokat.

A lényeg röviden
  • Az Anthropic az Accenture-rel indít független frontiermodell-értékeléseket.
  • Kalifornia AI-vészleállítót és külső biztonsági ellenőrzést sürget.
  • A libheif hibája távoli kódfuttatást tett lehetővé Next.js-ben.
  • A Roboflow szerint a GPT-6 Astra a legerősebb látásmodelljük.
  • A Google AI-ügynökökkel keres és javít infrastruktúra-sebezhetőségeket.

Független ellenőrzés és AI-biztonság

Az Anthropic az Accenture-rel kötött partnerséget, hogy beágyazott, független értékelőkkel tegye ellenőrizhetőbbé frontier AI-modelljeinek biztonságát. Az együttműködés modellteszteket, red-teaminget, igazodási vizsgálatokat és védelmi mechanizmusok tesztelését is magában foglalja. Részletek az Anthropic és az Accenture partnerségéről.

Gavin Newsom kaliforniai kormányzó rendeletben gyorsítaná fel az AI-rendszerek független biztonsági ellenőrzését, és szakértői javaslatokat kér a frontier modellek vészleállítójához. Az állam azt szeretné, hogy szabályozási kerete országos mintává váljon. A Center for Data Innovation szerint ugyanakkor a vészleállító önmagában nem állítaná meg a veszélyes AI-ügynököket, és új kiberbiztonsági, valamint nemzetbiztonsági kockázatokat is teremthet. Kalifornia terve és a vészleállító korlátai.

Biztonság a fejlesztésben és a platformokon

A Next.js képfeldolgozásán keresztül távoli kódfuttatást lehetővé tevő hiba volt elérhető a libheif AVIF-dekóderben. A Vercel és a Hacktron reprodukálta a problémát, a Vercel letiltotta az érintett funkciókat, a libheif karbantartója pedig kiadta a javított v1.23.2-es verziót. A libheif hibájának részletei.

A Google AI-ügynökökkel vizsgálja folyamatosan az infrastruktúrájára kerülő kódot. A vállalat szerint a rendszer havonta több száz sebezhetőséget akadályoz meg abban, hogy a kódbázisba vagy az éles környezetbe jusson, és a javításra is képes javaslatot készíteni. A GitLab szerint a biztonsági ellenőrzéseknek a tervezéstől az élesítésig a fejlesztési folyamat részét kell képezniük, míg a GitLab 19.4 szabályozható MCP-eszközöket és új biztonsági vizsgálatokat hozott. A Google AI-ügynökeiről, a GitLab biztonsági megközelítéséről és a GitLab 19.4-ről.

Modellek és kutatási eredmények

A Roboflow tesztjei alapján a GPT-6 Astra az eddig vizsgált legerősebb látásmodelljük. Objektumfelismerésben, számlálásban és vizuális következtetésben is magas pontszámokat ért el. A GPT-6 Astra tesztjei.

A Berkeley kutatói ProteinGuide néven olyan módszert fejlesztettek, amely kísérleti adatokkal irányítja a meglévő fehérjegeneráló modelleket a kívánt tulajdonságok felé, újratanítás nélkül. A Nature Biotechnology tanulmánya szerint a módszer egyetlen tervezési kör után is nagy aktivitású adeninalapú fehérjét eredményezett. A ProteinGuide módszere.

A fal.ai szerint a H3 Max öt másodperces videót kevesebb mint három másodperc alatt generál. Az Apple kutatói közben a torzítás csökkentésére DSO-t, jailbreak-támadások mérséklésére ritka jellemzőkre épülő módszert, a generatív modellek irányítására pedig LinEAS-t mutattak be. A H3 Max bemutatója, a DSO kutatás, a jailbreak elleni megoldás és a LinEAS.

Üzleti és fejlesztői újdonságok

Az OpenAI bemutatta az Australian Youth Safety Blueprintet, amely hat pillérben foglalja össze a fiatalok AI-használatának védelmét, az AI-műveltségtől és az életkorhoz igazított intézkedésektől a szülői felügyeletig. Az ausztrál terv.

A Character.AI vezérigazgatója, Karandeep Anand a Disney újonnan létrehozott technológiai vezetői pozíciójában folytatja, miközben a Character.AI alkalmazása továbbra is elérhető marad. A Vercel mcp-handler csomagja kísérleti WebMCP-támogatást kapott, a TypeSafe Jev pedig döntéseket hoz, osztályoz és útvonalat választ, de nem generál szabad szöveget. Karandeep Anand új szerepe, a WebMCP-támogatás és a Jev modell.

A nap további hírei között szerepel az Amazon közel 400 Leo műholdja, a Factory Private saját VPC-s és leválasztott hálózati futtatása, az NVIDIA AIPerf mérőeszköze, az ASUS 80 TOPS teljesítményű Ascent QN10 mini PC-je, valamint a Krea Agent idővonalas videóvágója. Amazon Leo, Factory Private, AIPerf, Ascent QN10 és Krea Agent.

Kapcsolódó hírek

AI hírek 10.03.: nyílt modellek, humanoid robot és szigorodó jogi AI szabályok
Összefoglalók2026. október 3. 21:00

AI hírek 10.03.: nyílt modellek, humanoid robot és szigorodó jogi AI szabályok

A nap két kiemelt fejleménye a nyílt mesterséges intelligencia és a robotika területéről érkezett. Az Aleph Alpha bemutatta Kolibri modelljét, a RoboParty pedig nyílt…

AI hírek 10.02.: GPT-6, Blackwell és az AI-infrastruktúra gyorsulása
Összefoglalók2026. október 2. 21:00

AI hírek 10.02.: GPT-6, Blackwell és az AI-infrastruktúra gyorsulása

Az OpenAI GPT-6 Astra Ultrafast módja NVIDIA Blackwell GPU-kon vált elérhetővé, miközben a vállalat útmutatót is kiadott a GPT-6 modellek használatához. A nap hírei az…

AI hírek 10.01.: új szabályok, ügynökinfrastruktúra és modellek
Összefoglalók2026. október 1. 21:00

AI hírek 10.01.: új szabályok, ügynökinfrastruktúra és modellek

Kalifornia több új törvénnyel és végrehajtási rendelettel szabályozza a munkahelyi, egészségügyi és digitális megtévesztési célú AI-rendszereket. Közben az AI-ügynökök…