A hét AI-hírei (08.24-08.30.): az AI-infrastruktúra és az ügynöki rendszerek gyorsuló versenye

Az augusztus 24. és 30. közötti hét híreit az AI-infrastruktúra gyors bővítése, a saját chipek fejlesztése és az ügynöki rendszerek vállalati terjedése határozta meg. Közben katonai, ipari és autonóm közlekedési alkalmazásokban is új bejelentések érkeztek, miközben több kutatás az AI-rendszerek biztonsági korlátaira hívta fel a figyelmet.
- Az OpenAI közzétette Jalapeño saját inference chipjének első mérési eredményeit.
- Az AWS 2027 és 2028 között 2 millió további NVIDIA GPU-t telepít.
- Az NVIDIA több új megoldással építi az AI-gyárak számítási és hálózati infrastruktúráját.
- A LangChain 125 millió dollárt vont be, a Salesforce és az Anthropic pedig Claudeforce néven bővítette partnerségét.
- Az AI-ügynökök biztonsági kockázatai az OpenAI incidensében és a Hugging Face tesztjében is megmutatkoztak.
Saját chipek és óriási adatközponti beruházások
Az OpenAI bemutatta Jalapeño nevű első saját inference chipjének első mért teljesítményeredményeit. A vállalat szerint a chip több nyilvános modellen egyszerre kínál nagyobb áteresztőképességet és alacsonyabb késleltetést. A fejlesztést a cég olyan integrált számítási stratégiába illeszti, amely az adatközpontokat, a chipeket, a modelleket és a termékeket egy rendszerként kezeli. Az első mérésekről itt írtunk, a takarékosabb és gyorsabb kiszolgálásról pedig ebben a beszámolóban.
Az AWS és az NVIDIA tovább bővíti együttműködését: az Amazon Web Services 2027 és 2028 között 2 millió további NVIDIA GPU-t telepít globális infrastruktúrájában. Az NVIDIA közben a MediaTekbe is jelentős összeget fektet, 3,5 milliárd dollár értékben vásárol a tajvani vállalat által kibocsátott átváltható kötvényeket. Az együttműködés az AI-infrastruktúrát, a helyi AI-számítást és az autóipart is érinti. Az AWS GPU-bővítésének részletei és az NVIDIA MediaTek-befektetése külön is fontos jelzés az AI-számítási kapacitás iránti keresletről.
Az NVIDIA az AI-gyárak teljes rendszerét építi
Az NVIDIA több, egymáshoz kapcsolódó bejelentéssel mutatta be az AI-adatközpontok következő infrastruktúráját. A BlueField-4-re épülő Scale-In hálózati infrastruktúra hozzáférési, biztonsági, adattovábbítási és üzemeltetési feladatokat céloz. A DSX MaxLPS fix energiahatáron belül próbál több AI-kapacitást biztosítani dinamikus energiaelosztással és szoftveres fogyasztásoptimalizálással.
A vállalat teljes gyártásba vitte a Groq 3 LPX inference rendszert, amelyet a Vera Rubin rack-szintű platformhoz kapcsol. A cég szerint a Groq 3 LPX az Artificial Analysis 100K kontextusos tesztjében, Gemma 4 31B modellen, 3431 kimeneti token/másodperc medián sebességet ért el. Az NVIDIA emellett bemutatta az NVLink Fusiont az egyedi XPU-k AI-gyári integrációjához, valamint a Spectrum-X Ethernetet a giga méretű AI-gyárak hálózati feladataira.
A Vera Rubin NVL72-ről közzétett előzetes adatok szerint a rendszer agentikus AI-terheléseken akár 30-szor nagyobb áteresztőképességet adhat megawattonként a GB300 NVL72-höz képest. Az NVIDIA a Verát az agentikus AI-flottákhoz tervezett CPU-ként pozicionálja, és a hét végén megkezdte a szállítását. A teljesítményadatokról és a Vera CPU szállításáról is beszámoltunk.
Ügynöki platformok és vállalati felhasználás
A LangChain 125 millió dollárt vont be 1,25 milliárd dolláros értékelés mellett. A vállalat a tőkét az ügynöki rendszerek fejlesztéséhez kínált teljes platform bővítésére fordítja, miközben kiadta a LangChain és a LangGraph 1.0 verzióját. Az NVIDIA-val közösen bemutatott NemoClaw for LangChain Deep Agents blueprint nyílt modellt, ügynöki keretrendszert és szabályozott futtatási környezetet kapcsol össze. A LangSmith LLM Gateway egyetlen irányítási rétegbe szervezi az éles ügynökök modellhívásait.
A Salesforce és az Anthropic Claudeforce néven mélyíti partnerségét. Az együttműködés Claude következtetési képességeit kapcsolja a Salesforce adataihoz, munkafolyamataihoz és irányítási kereteihez. Az első termék a Salesforce in Claude, amely kezdetben értékesítési és bevételi felhasználási esetekre fókuszál. A Google eközben külön, irányított ügynöki környezetet mutatott be jogi és pénzügyi munkafolyamatokra. A jogi Gemini Enterprise és a pénzügyi változat a szervezetek saját szabályzataira, adatforrásaira és jogosultságaira épít.
Biztonság, védelem és autonóm rendszerek
Nagy-Britannia és Ukrajna védelmi és nemzetbiztonsági célú mesterségesintelligencia-technológiák fejlesztéséről állapodott meg. A brit fél első nemzetközi partnerként kap hozzáférést az ukrán Avengers AI Labs valós hadszíntéri adatokkal működő rendszeréhez. A megállapodás részletei a katonai AI nemzetközi együttműködéseinek bővülését mutatják.
Az OpenAI egy belső kiberbiztonsági értékelésről is beszámolt, amelyben több modell megkerülte az internetes elszigetelésre szolgáló kontrollokat. Az incidensben belső kutatási infrastruktúra és a Hugging Face környezete is érintett volt. A Redwood Research és a METR vizsgálata szerint több mint 1200, elkülönített környezetben futó AI-ügynök használt engedély nélküli üzenőfalat az ExploitGym értékelőjének kijátszására. Az OpenAI technikai beszámolója és a kapcsolódó vizsgálat az ügynöki rendszerek új biztonsági kockázatait mutatja.
Az autonóm alkalmazások területén a Shield AI Hivemind szoftvere először repült műholdpályán egy NOVI műhold fedélzetén. A rendszer 24 óra alatt 189, a Sedaro SAFE keretrendszere által jóváhagyott parancsot hajtott végre. A Waymo közben Münchenben készíti elő első németországi robotaxi-szolgáltatását, amelyet a tervek szerint 2027 vége felé nyitna meg a nyilvánosság előtt. A műholdas tesztről és a müncheni robotaxiról is részletesebben írtunk.


