AI hírek 08.11.: NVIDIA ügynöki modelljei és a kiberbiztonság új frontja

A NVIDIA több bejelentéssel erősítette a helyben futó, ügynöki AI ökoszisztémáját: megjelent a Nemotron 3.5 Lightning, valamint a modellek közötti választást segítő NeMo Switchyard. Közben az OpenAI kiberbiztonsági modelljei AWS-en váltak elérhetővé, a Mistral pedig európai számítási kapacitást és regionális inferenciát ígért.
- A NVIDIA bemutatta a Nemotron 3.5 Lightning nyílt, 30B méretű ügynöki modelljét.
- A NeMo Switchyard feladatonként választ modellt az AI-ügynökök számára.
- Az OpenAI Daybreak kiberbiztonsági képességei elérhetők az Amazon Bedrockon.
- A Mistral regionális inferenciát és európai számítási kapacitást építene.
- A MAI-Image-2.6 második lett az Arena képgeneráló ranglistáján.
NVIDIA: nyílt modellek és modellválasztás ügynökökhöz
A NVIDIA bemutatta a Nemotron 3.5 Lightning nyílt, 30B méretű mixture-of-experts modelljét, amely 3B aktív paraméterrel működik. A rendszert hosszú ideig futó AI-ügynökök nagy volumenű, alacsony késleltetésű feladataira tervezték.
A vállalat ezzel együtt ismertette a NeMo Switchyard modellválasztó réteget is. Ez az ügynökök feladatait specializált és frontier modellek között irányítja, így a fejlesztők nem feltétlenül egyetlen modellt használnak minden munkafolyamathoz. A Nemotron elérhetővé vált az Ollamában, és ingyenesen megjelent a Cline-ban is.
A helyben futtatás irányát erősíti, hogy a Factory autonóm szoftvergyárát is erre a modellre építi a DGX Spark platformon. A NVIDIA emellett az 800 VDC-s tápellátási architektúrát és a Jetsonhoz készült, agentikus videós képességeket is bemutatta.
Kiberbiztonság és vállalati AI-infrastruktúra
Az OpenAI Daybreak kiberbiztonsági képességei elérhetővé váltak az Amazon Bedrockon. A vállalati csapatok így meglévő AWS-környezetükön keresztül férhetnek hozzá a frontier kibermodellekhez.
A Vercel szerint már most is léteznek olyan nyílt súlyú modellek, amelyek támadási lehetőségeket kutatnak, ezért a fejlesztőcsapatoknak a jelenleg használható rendszerekkel kell megkezdeniük a védekezést. A SambaNova közben az ügynökök miatt prémium kategóriává váló gyors modellkiszolgálásról írt.
A Weaviate új effort paramétere a keresésre fordított számítási kapacitást szabályozza. Az NVIDIA ökoszisztémájában a CodeRabbit alacsonyabb költségű kódellenőrzési útválasztást tanított a Nemotronra.
Modellek, fejlesztői eszközök és kreatív AI
A Microsoft MAI-Image-2.6 modellje második helyre került az Arena képgeneráló ranglistáján, az előző verzióhoz képest 79 Elo-pontos javulással. A GitHub Copilotban élesbe állt a MAI-Code-1.1-Flash, amely a Microsoft szerint gyorsabb, jobb minőségű és az előző modell árának negyedébe kerül.
A GeoPT fizikai kölcsönhatások szimulációival tanítja az AI-modelleket. A kreatív területen a Luma Scenes eszköze storyboardot készít a teljes videó renderelése előtt, a Seedance 2.5 pedig a Krea felületén akár 30 másodperces klipeket és 50 multimodális referenciát kezel.
Megjelent a Modular Mojo 1.0, miközben a Cartesia Ink-2 új kulcsszavas befolyásolást és állítható fordulófelismerést kapott.
Kutatás, orvosi AI és európai szuverenitás
A Microsoft Research CARE-X radiológiai kutatási modellje mellkasröntgenek többféle értelmezési feladatát célozza, de nem orvostechnikai eszköz. A Google Research AMIE (Video) rendszerét szimulált klinikai videókonzultációkban tesztelte.
A Mistral három lépést jelentett be a szuverén AI erősítésére, regionális inferenciával, szélesebb nyíltmodell-támogatással és európai számítási kapacitásra épülő infrastruktúrával. A Berkeley kutatói szerint a helyi, nyílt modellek egyes feladatokban mérsékelhetik az adatközpontoktól való függést.
A nap további hírei között szerepel a ChatGPT-hirdetések újabb piacokra terjesztése, az IBM ALTK-Evolve megközelítése, valamint a kaliforniai Teen Tech Council létrehozása.


