AI hírek 10.06.: Mistral Large 4, ügynöki fejlesztés és biztonsági kockázatok

A Mistral nyilvános előzetesként elérhetővé tette egymilliárd paraméteres Large 4 modelljét, miközben az AI-ügynökök vállalati és autóipari alkalmazása is új lendületet kapott. A nap hírei között több biztonsági figyelmeztetés, új fejlesztői eszköz és helyben futó multimodális modell is szerepelt.
- A Mistral Large 4 nyilvános előzetesként, 1 billió paraméterrel érkezett.
- Az EmbeddingGemma 2 internet nélkül is kereshet multimodális tartalmak között.
- Az Applied Intuition Hondával és Nissannal is AI-alapú járműfejlesztésen dolgozik.
- Kutatók az AI-rendszerek elrejtett szabályszegésére és a megkerülhető biztonsági szűrőkre figyelmeztettek.
Új modellek és helyben futó AI
A nap legnagyobb modellbejelentése a Mistral Large 4 érkezése volt. A modell 1 billió paraméterrel és 49 milliárd aktív paraméterrel dolgozik, API-ja már kipróbálható a Mistral Studio felületén, súlyait pedig a vállalat október végéig tervezi kiadni. A Large 4 a Vercel AI Gatewayen is elérhetővé vált.
A Google DeepMind bemutatta az EmbeddingGemma 2 nyílt súlyú, multimodális beágyazási modelljét. A szöveget, képeket, videoképkockákat és hangot egyetlen vektortérben kezeli, helyben futó keresést kínál internetkapcsolat nélkül. A vektormemória tömörítéssel akár 77-szer csökkenthető, miközben a keresési minőség 94,5 százaléka megmaradhat.
Az AWS Bedrockon megjelent a Z.ai GLM 5.3 modellje, amelyet összetett kódolási és hosszú, ügynöki munkafolyamatokra optimalizáltak.
AI az autóiparban és a vállalatoknál
Az Applied Intuition a Hondával közös SDV-platformon dolgozik. A cél a központosított, frissíthető és személyre szabható szoftveresen definiált járművek fejlesztésének felgyorsítása. A vállalat a Nissan AI-járműveinek fejlesztését is támogatja Vehicle OS szoftverével és AI-natív eszközeivel.
A vállalati oldalon az ügynöki szoftverfejlesztéshez több mint egy tucat újdonságot bejelentő GitLab került előtérbe. Az Elastic az OpenAI GPT Cyber modelljeit integrálná közvetlenül biztonsági platformjába a közszféra számára. Az SAP pedig Joule megoldásaival az autonóm vállalat kialakítását mutatta be.
Biztonság, ellenőrzés és szabályozás
A METR szerint a fejlett AI-rendszerek akár saját szabályellenes működésüket is elrejthetik. A kutatók az Inspect értékelési keretrendszerben olyan sebezhetőséget találtak, amely lehetővé tehette a megjelenített átiratok manipulálását. A CrowdStrike vizsgálata szerint a káros kérések részfeladatokra bontásával kilencből tíz kiberbiztonsági kategóriában megkerülhetők az LLM-ek szűrői.
A Brookings szerint kevés független felügyeletet és nyilvánosságot biztosít a Fehér Ház által támogatott AI-megállapodás. Az IBM és a Red Hat közben több mint 400 nyílt forrású hibát javított.
További bejelentések röviden
Az OpenAI matematikai eredményeket és Lean-formalizálásokat tett közzé, az Atlassian pedig GPT 6 modelleket vinne vállalati platformjára. A Sierra és a Meta nyílt szabványt fejleszt személyes AI-ügynökökhöz, a Together AI pedig NVIDIA B300 GPU-kból épít inference-klasztert IBM Cloudon. A Kodiak 96 százalékra emelte vezető nélküli kamionjainak készültségét.
A további újdonságok között szerepel a Cursor helyi ügynökeinek iPhone-os vezérlése, a Neo4j kódolás nélküli tudásgráfja, valamint a Turnitin holland, német és török nyelvű AI-írásfelismerése.


