AI hírek 07.27.: ügynökbiztonság, nyílt modellek és vállalati AI

A július 27-i AI-hírek középpontjában az önállóan működő rendszerek biztonsága, a nyílt modellek és a vállalati munkafolyamatok álltak. A Microsoft több kiberbiztonsági megoldást mutatott be, miközben az NVIDIA az ügynökarchitektúráktól a chiptervezésig és a kvantumszámítógépek kalibrálásáig több területen jelentett be újdonságokat.
- A Hugging Face szerint az AI-ügynökök tényleges végrehajtási képességeit is vizsgálni kell.
- A Fireworksön elérhetővé vált a 2,8 ezermilliárd paraméteres Kimi K3.
- A Microsoft MAI-Cyber-1-Flash modellje az MDASH rendszer részeként működik.
- Az NVIDIA többek között chiptervezési, sebészeti robotikai és kvantumkalibrálási fejlesztéseket mutatott be.
- Az Anthropic nem támogatja az open-weights modellek általános betiltását.
Ügynökök: nemcsak a gondolkodást kell figyelni
A Hugging Face technikai idővonala szerint az AI-ügynökök biztonsági vizsgálatakor nem elég a modellek gondolkodását elemezni. Azt is pontosan fel kell mérni, milyen műveleteket tudnak ténylegesen végrehajtani, és különbséget kell tenni a megfigyelés, valamint a beavatkozás között.
Az NVIDIA szerint az ügynökök felépítése szintén meghatározó. A NOOA nyílt forráskódú kutatási előzetes egyetlen Python-osztályként kezeli az AI-ügynököt, az architektúrát pedig a modellválasztáshoz hasonlóan fontosnak tartja a teljesítmény és a költség szempontjából. Vállalati oldalon a Cohere North Automations természetes nyelven megadott célokból épít, futtat és felügyel összetett munkafolyamatokat.
Modellek és kiberbiztonsági védelem
A Fireworks elérhetővé tette a Moonshot AI 2,8 ezermilliárd paraméteres Kimi K3 modelljét következtetésre és tanításra. A vállalat szerint a nyílt súlyú rendszer több független mérésben közelíti a zárt modellek szintjét, használata pedig tokenalapú költségmodellre épül.
A Microsoft bemutatta első kifejezetten kiberbiztonsági modelljét, a MAI-Cyber-1-Flash-t. Az MDASH többügynökös rendszerrel együtt a CyberGym tesztjén a vállalat szerint 96 százalékos eredményt ért el, és a vezető modellek költségének 50 százalékáért nyújt hasonló szintű teljesítményt. A Project Perception önálló biztonsági rendszerként próbál fellépni az AI-alapú támadások ellen, nyilvános előzete augusztus 3-án indul.
Az NVIDIA és partnerei közben elindították az Open Secure AI Alliance nyílt AI-biztonsági együttműködést. Az Anthropic szerint az open-weights modellek általános betiltása nem megfelelő válasz, helyette többek között a fejlett chipek exportjának korlátozását és a modelllepárlás visszaszorítását támogatja.
NVIDIA: chiptervezés, szimuláció és kvantumkalibrálás
Az NVIDIA a Vera CPU-t saját következő generációs CPU-i és GPU-i tervezési folyamataiba vezeti be. A Cadence és a Synopsys alkalmazásaival végzett korai tesztekben egyes munkafolyamatok teljesítménye akár 1,5-szeresére nőtt.
A vállalat Cosmos-H-Dreams néven valós idejű generatív szimulációt mutatott be sebészeti robotikához. Az Ising Calibration 1.5 31 milliárd paraméteres látás-nyelvi modell, amely kvantumprocesszorok diagnosztikai eredményeit elemzi és kalibrációs műveleteket javasol. A rendszer nyílt forráskódú.
Az NVIDIA és az Applied Materials a chipgyártás fejlesztését gyorsító, teljes láncot összekötő digitális modellt épített. A Nemotron 3 Ultra az ACE-RTL ügynökkel együtt 97,1 százalékos átlagos megfelelési arányt ért el kilenc RTL-feladatkategóriában.
Vállalati terjedés és új alkalmazások
Az Anthropic és a Cognizant kiterjeszti partnerségét, hogy a Claude szélesebb körben jusson el vállalati ügyfelekhez. A Microsoft az EXTRA kezdeményezéssel 18 egyetemi labor támogatásával épít globális külső szakértői hálózatot.
Az OpenAI kutatása szerint a ChatGPT munkahelyi használata során egyes feladatok más szakmák dolgozóihoz kerülnek, különösen az ügyfélélmény, a design és a humánerőforrás területén. A Meta közel 2 millió dolláros programban 30 szervezet AI-szemüveges projektjét támogatja. A Fantasy Premier League menedzserei Copilot által támogatott tanácsokat, adatokat és játékosjavaslatokat kapnak, míg a Harvey egy év alatt 0,94 millióról 24,8 millióra növelte a heti feldolgozott dokumentumok számát.


