AI hírek 07.15.: új multimodális modellek és szigorodó AI-biztonság

A Thinking Machines új multimodális modellel jelentkezett, miközben az OpenAI automatizált támadásokkal tesztelné az AI-rendszerek biztonságát. A nap hírei között benchmarkok, ipari partnerségek és szabályozási javaslatok is szerepelnek.
- A Thinking Machines bemutatta az Inkling multimodális modellt.
- Az OpenAI GPT-Red automatizáltan teszteli az AI-rendszerek biztonságát.
- A Hugging Face új beszéd-AI-benchmarkot indított.
- Az NVIDIA és partnerei Japánban fizikai AI-ökoszisztémát építenek.
- Az OpenAI összehangolt amerikai AI-biztonsági szabályokat sürget.
Új modellek és mérési módszerek
A Thinking Machines a Hugging Face-en mutatta be az Inkling multimodális modellt. A rendszer szövegek, képek és hangok feldolgozására készült, emellett változtatható gondolkodási erőfeszítést alkalmaz.
A képgenerálás hatékonyságát célozza a RepTok, amely egyetlen folytonos látens tokennel reprezentálja a képeket. A fejlesztők szerint ez hatékonyabbá teheti a generatív modellek tanítását. A hangalapú rendszerek összehasonlítására a Hugging Face Real World VoiceEQ benchmarkot indított, rendezhető hőtérképes modellranglistával.
AI-biztonság és szabályozás
Az OpenAI bemutatta a belső használatra fejlesztett GPT-Red modellt, amely automatizáltan keres biztonsági réseket AI-rendszerekben. A vállalat szerint a modell már a tanítás során támadásokat generál, ezzel javítva a gyártásba kerülő rendszerek ellenálló képességét.
Az OpenAI emellett összehangolt amerikai AI-biztonsági szabályokat sürget. A javasolt keret dokumentált kockázatértékelést, incidensjelentést és független auditokat tartalmazna. A pénzügyi alkalmazásokhoz a Langfuse automatikus PASS/FAIL átvilágítási kaput épített, amely többek között a számszerű pontosságot, a forrásokra támaszkodást és a megfelelést méri.
Ipari alkalmazások és infrastruktúra
Az NVIDIA Japánban fizikai AI ipari ökoszisztémát épít gyártókkal, robotikai cégekkel, startupokkal és a kormánnyal. A kezdeményezések a robotikától és az ellátási lánctól az egészségügyig terjednek.
A Microsoft és a 3M stratégiai partnerséget kötött az AI-adatközpontok infrastruktúrájáról. Az Azure lesz az első bejelentett hiperskálázott felhőszolgáltató, amely bevezeti a 3M Expanded Beam Optical technológiáját. Az NVIDIA CUDA 13.3 új clmad PTX-utasítása az NVIDIA mérései szerint gyorsítja a GHASH hitelesítési hash-t és a nulla tudású bizonyítások egyik alapműveletét.
Kutatási eredmények és további bejelentések
Az AI21 Labs többmodellű kódolási architektúrája 80,8 százalékos SWE-Bench Pro eredményt ért el, feladatonként 5,99 dolláros átlagos költséggel. Az MIT neurális átláthatósági eszköze egy személyre szabott chatbot várható viselkedését jeleníti meg még a beszélgetés előtt.
A nap további hírei: az IBM a modellútválasztást rendszerszintű optimalizálásként elemzi, a Google Research a diffúziós modellek kreativitását score smoothinggal magyarázza, a Boston Dynamics Atlas robotja pedig a FIFA-világbajnokság szünetében mutatkozott be. A Salesforce Argentína első tartományi AI-megállapodását kötötte Entre Ríos tartománnyal. A Microsoft új fenyegetési hírszerzési szolgáltatást indított, az AWS-nél pedig Dave Treadwell veszi át a számítási és gépi tanulási üzletág vezetését augusztus 1-jétől. Az NVIDIA nanousd-labs projektje könnyű USD-futtatókörnyezetet generál AI-ügynökökkel.


