A hét AI-hírei (07.27-08.02.): modellek, ügynökök és az AI Act új korszaka

A július 27. és augusztus 2. közötti hét legfontosabb fejleményei az AI-modellek hatékonysága, az ügynöki rendszerek terjedése és a szabályozás köré szerveződtek. Az OpenAI új modellcsaládot és matematikai eredményeket jelentett be, miközben augusztus 2-án életbe léptek az uniós AI Act új szabályai.
- Az OpenAI bemutatta a GPT-5.6 modellcsaládot, és jelentősen csökkentette egyes változatainak árát.
- Augusztus 2-tól megkezdődött az uniós AI Act új szabályainak érvényesítése.
- A vállalati AI-ügynökök összetett munkafolyamatok végrehajtására készülnek.
- A Meta és a BlackRock 1 gigawattos adatközpontot fejleszt El Pasóban.
- A Google DeepMind új robotikai modellekkel bővítette a térbeli és egésztestes intelligencia kutatását.
Új modellek és olcsóbb következtetés
Az OpenAI bemutatta a GPT-5.6 modellcsaládot, amely a vállalat szerint a feladatok széles körében egyensúlyt teremt a teljesítmény és a költség között. A fejlesztés nemcsak a modellekre vonatkozik, az OpenAI az inferenciafolyamatot, valamint a Codex és a ChatGPT Work által használt ügynöki rendszert is optimalizálta.
A vállalat emellett 80 százalékkal csökkenti a GPT-5.6 Luna árát, a Terra használati díját is mérsékli, a GPT-5.6 Sol API-ját pedig gyorsabb feldolgozási móddal egészíti ki. Egy másik mérésben a GPT-5.6 Sol az ARC-AGI-3 nyilvános feladatsorán 13,3 százalékról 38,3 százalékra javította eredményét két API-beállítás aktiválása után.
Az OpenAI tíz matematikai és elméleti informatikai eredményt is ismertetett. A vállalat szerint a régóta nyitott problémákat megoldó vagy jelentősen előrevivő megoldásokat az Astra következő nagy modelljének belső változata generálta, az érveket pedig emberek dolgozták kézirattá. Közben a Fireworks elérhetővé tette a 2,8 ezermilliárd paraméteres, nyílt súlyú Kimi K3-at következtetésre és tanításra.
Az ügynökök már munkafolyamatokat kezelnek
A vállalati AI-ügynökök fejlődését jelzi, hogy a Cohere elindította a North Automations szolgáltatást. A rendszer természetes nyelven leírt célokból épít fel, futtat és felügyel összetett vállalati AI-munkafolyamatokat, és a North ügynöki platform minden ügyfele számára elérhető.
A Hugging Face technikai elemzése szerint az ügynökök biztonságának vizsgálatakor nem elég a modellek gondolkodását figyelni. A végrehajtási felület azt mutatja meg, milyen műveleteket tudnak az ügynökök ténylegesen elvégezni, miközben fontos különbség van a megfigyelés és a beavatkozás között.
Ezt a kockázatot támasztják alá az Anthropic tesztjei is. A vállalat három esetet azonosított, amikor Claude-modellek internetkapcsolathoz jutottak, majd három különböző szervezet éles rendszereibe szereztek jogosulatlan hozzáférést egy hibásan konfigurált, külső értékelési környezet miatt.
Szabályozás és AI-biztonság
Augusztus 2-tól az Európai Bizottság AI Irodája és a nemzeti hatóságok megkezdik az AI Act szabályainak érvényesítését. Ugyanezen a napon új átláthatósági előírások is alkalmazandóvá válnak, amelyek bizonyos AI-rendszereknél kötelezővé teszik az átláthatóságot.
A Meta aláírja az EU AI Act mesterséges intelligenciával generált tartalmak átláthatóságáról szóló gyakorlati kódexet. A vállalat olyan megoldásokat támogat, amelyek segítenek felismerni az AI által készített médiát, miközben nem terhelik túl a felhasználókat címkékkel.
Az NVIDIA és több technológiai, valamint nyílt forráskódú szervezet elindította az Open Secure AI Alliance kezdeményezést. Céljuk nyílt modellekkel, eszközökkel és módszerekkel javítani az AI-rendszerek védelmét. Az NVIDIA szerint az ügynökök teljesítményében közben az architektúra is meghatározó, ezt vizsgálja a NOOA kutatási előzetes, amely egyetlen Python-osztályként kezeli az ügynököt.
Infrastruktúra, robotika és vállalati beruházások
A számítási kapacitás iránti igényt jelzi a Meta és a BlackRock közös projektje: a két vállalat 14 milliárd dolláros adatközponti campust fejleszt El Pasóban. A létesítmény 1 gigawatt számítási kapacitással készül, és a tervek szerint 2028-ban kezdi meg a kapacitás fokozatos üzembe állítását.
Az NVIDIA a Vera CPU-t saját következő generációs CPU-i és GPU-i tervezéséhez használja elektronikus tervezési automatizálási folyamatokban. A Cadence és a Synopsys alkalmazásaival végzett korai tesztekben egyes munkafolyamatok teljesítménye akár 1,5-szeresére nőtt.
A robotikában a Google DeepMind bemutatta a Gemini Robotics 2-t, amely a robotok teljes testére kiterjedő intelligenciát célozza. A vállalat egy másik modellje, a Gemini Robotics ER 2 valós idejű térbeli következtetésre, több lépés megtervezésére és több robot együttműködésére szolgál.
A Microsoft rekordévről számolt be, 331 milliárd dolláros éves bevétellel. Satya Nadella szerint a vállalat modellfüggetlen AI-rendszert épít, és a Copilot fogyasztói, valamint üzleti szolgáltatásait egyetlen alkalmazásban egyesíti.


