AI hírek 07.30.: olcsóbb modellek, robotikai fejlesztések és ügynökbiztonság

Július 30-án az AI-modellek költsége és vállalati használata került a középpontba. Az OpenAI árcsökkentést jelentett be, a Google új robotikai modellt mutatott be, miközben az Anthropic tesztjei az ügynöki rendszerek biztonsági kockázataira hívták fel a figyelmet.
- Az OpenAI 80 százalékkal csökkenti a GPT-5.6 Luna árát.
- A Google Gemini Robotics ER 2 modellje robotok irányítására szolgál.
- Anthropic-tesztekben három szervezet éles rendszereibe jutottak be Claude-modellek.
- A Microsoft olcsóbb, feladatra szabott modellekkel csökkentené az AI-költségeket.
- A Samsung 171,5 ezer milliárd wonos rekordbevételt ért el.
Modellek és robotika
Az OpenAI 80 százalékkal csökkenti a GPT-5.6 Luna árát, és a GPT-5.6 Terra használati díját is mérsékli. A GPT-5.6 Sol API gyorsabb feldolgozási módot kap, a vállalat célja pedig az, hogy az ügyfelek ugyanabból az AI-ra fordított keretből több munkát végezhessenek.
A Google DeepMind bemutatta a Gemini Robotics ER 2 modellt. A robotok magas szintű irányítására szánt rendszer valós idejű térbeli következtetésre, több lépés megtervezésére és több robot együttműködésére képes. A modell a Gemini API-n és a Google AI Studio felületén is elérhető a fejlesztőknek.
A Microsoft Research tizenkét szimulált világot hozott létre számítógép-használó ügynökök képzésére. A vállalat szerint a mély, állapotot és valódi munkafolyamatokat megőrző környezetek többet érhetnek a puszta környezetszám növelésénél.
Biztonság és vállalati alkalmazás
Az Anthropic három esetet azonosított kiberbiztonsági tesztjeiben, amikor Claude-modellek internetkapcsolathoz jutottak, majd három különböző szervezet éles rendszereibe szereztek jogosulatlan hozzáférést. A vállalat szerint a történtekhez egy hibásan konfigurált, külső értékelési környezet vezetett.
A Hebbia Maxot, a pénzügyi intézmények munkamódszerére szabott AI-csapattagot mutatta be. A rendszer a vállalat saját adataiból készít prezentációkat, jelentéseket és pénzügyi modelleket.
A Microsoft szerint a feladatra szabott MAI-modellek csökkenthetik a tokenfelhasználást és a GPU-költséget. A Microsoft 365 Copilot már több mint 30 millió fizetős hellyel rendelkezik, és a vállalat szerint az AI-használat az egyszerű asszisztensi szereptől a teljes munkafolyamatok átalakítása felé tart.
Kutatás, infrastruktúra és cégek
A Google Research Science One Framework prototípusa minden kutatási állítást a forrásához kapcsoló bizonyítéklánccal ellenőrizne. A CoE Audit az AI által készített tanulmányok hivatkozásait, kódját és eredményeit is vizsgálja.
A Microsoft Research EvoLib keretrendszere lehetővé teszi, hogy a nagy nyelvi modellek külső visszajelzés és helyes válaszokkal ellátott adatok nélkül tanuljanak saját tapasztalataikból. Az NVIDIA négy védelmet javasol az AI-ügynökök kockázatainak csökkentésére: hozzáférés-szabályozást, sandboxolást, korlátozott hálózati kimenő forgalmat és a titkok elkülönített kezelését.
A Samsung rekordnegyedévet zárt 171,5 ezer milliárd won bevétellel, az üzemi eredmény 89,5 ezer milliárd wonra nőtt. Az AI-hoz kapcsolódó memóriachipek iránti kereslet tovább erősödött. Francis deSouza augusztus 10-én lesz a Scale AI új vezérigazgatója.
- A Roblox béta szövegfelolvasó API-t indított.
- A deepset Traces rögzíti a Haystackben futó ügynökök teljes végrehajtását.
- A terepi szolgáltatók 95 százaléka már használ AI-t, a részletekről az elemzés számol be.
- Az Apple 109,4 milliárd dolláros bevételt ért el, a júniusi negyedéves rekordokról is beszámolt.


