Alibaba 10 billió paraméteres Qwen-modelleket és új AI-chipeket készít

Az Alibaba bemutatta teljes stackre épülő AI-stratégiájának frissített ütemtervét, amely a chipektől és a felhős infrastruktúrától a modelleken át az AI-ügynökökig terjed. A vállalat szerint a következő Qwen-modellek akár 10 billió paraméteresek lehetnek.
- A Qwen 4 jelenleg tréning alatt áll, a Qwen 4.5 és Qwen 5 akár 10 billió paraméteres lehet.
- A Qwen3.8-Max 33 automatizált önfejlesztési ciklust teljesített.
- A Zhenwu V900 háromszor nagyobb teljesítményt ígér a Zhenwu M890-hez képest.
- A V900 sorozatgyártását 2027 első negyedévére tervezik.
- Az Alibaba Cloud AgentCore platformot indított vállalati AI-ügynökökhöz.
Qwen 4 és az önfejlesztő modellek
Az Alibaba szeptember 22-én, a hangcsoui Apsara Conference rendezvényen közölte, hogy a következő generációs Qwen 4 jelenleg tréning alatt áll. A vállalat emellett ismertette a Qwen 4.5 és Qwen 5 sorozatok ütemtervét is. Ezek mérete a tervek szerint 5 és 10 billió paraméter között alakulhat.
A cég beszámolója szerint a Qwen-modellek fejlesztésében már használják a visszacsatoláson alapuló rekurzív önfejlesztést, vagyis az RSI-t. A Qwen3.8-Max több mint egy hónapon át teljesen automatizált futásokban vett részt, amelyek során a rendszer a folyamat megtervezését, az adatok ellenőrzését, a kísérletezést és a hibák diagnosztizálását is elvégezte. Ezalatt 33 iterációs ciklust teljesített, Artificial Analysis-pontszáma pedig 40-ről 45-re nőtt.
Egy chiptervezési kísérletben a modell több mint 60 órán át javította önmagát a teljes tervezési folyamatban. Több mint 10 ezer EDA-eszközhívással gyártásra alkalmas chipbusz-modulokat készített, az Alibaba szerint 42 százalékkal csökkentett chipterület mellett, teljesítményromlás nélkül.
Új multimodális modellek és mobilügynökök
Az Alibaba több területen frissítette multimodális modellcsaládját. A Qwen3.8-LiveTranslate egy szinkrontolmácsolási modell, amely a vállalat szerint javítja a fordítás pontosságát, folyamatosságát és tömörségét. A késleltetés LAAL-mutatója 2,8 másodpercről 2,3 másodpercre csökkent.
A Qwen-Audio-3.1-TTS-Next szöveges forgatókönyvből párbeszédet és környezeti hangokat is tartalmazó filmes hangképet készít. Az Alibaba ezt hangoskönyvekhez, filmekhez és televíziós produkciókhoz, podcastokhoz, valamint játékokhoz szánja. A frissített beszédtechnológiai csomag része a Qwen-Audio-3.1-ASR, a Qwen-Audio-3.1-TTS és a Qwen-Audio-3.1-Realtime is.
A Qwen-Image 3.1 képgeneráló modell később, még az idén jelenhet meg. A vállalat szerint kreatív tervezési és e-kereskedelmi marketingfeladatokra optimalizálták, és támogatja az átlátszó hátterű képek natív létrehozását, valamint a sokoldalú képszerkesztést.
Az Alibaba elindította a Qwen Intelligence megoldást is, amelyet telefongyártóknak kínál. A Qwenre épülő ügynöki platform célja, hogy a következő generációs AI-telefonok megbízhatóbban hajtsanak végre összetett, több alkalmazást érintő feladatokat.
Zhenwu V900 és a következő Yitian processzorok
A vállalat chiptervező egysége, a T-Head bemutatta a Zhenwu V900 AI-képzési és következtetési processzort. Az Alibaba adatai szerint az új gyorsító háromszor nagyobb teljesítményt nyújt, mint a májusban kiadott Zhenwu M890. A V900 216 GB GPU-memóriával és 1200 GB/s chipközi sávszélességgel rendelkezik, és az FP8, illetve FP4 számábrázolási formátumokat is natívan támogatja.
A Zhenwu V900 sorozatgyártását és kereskedelmi megjelenését 2027 első negyedévére ütemezték. A T-Head közlése szerint Zhenwu AI-chipjeit több mint 650 ügyfél használja az autóiparban, a pénzügyben, a nagy nyelvi modellek, a fizikai intelligencia, az energiaipar és a gyártás területén.
Az Alibaba új szuperszervert is bemutatott, amely a Zhenwu V900-at, az ICN Switchet, a Panmai SmartNIC-et és a Zhenyue SSD-vezérlőchipet integrálja. A rendszer legfeljebb 500 ezer kártyából álló szupercsomópont-klasztert támogathat. A vállalat 2027-re tervezi új, ügynöki AI-feladatokra szabott processzorainak megjelenését is. A Yitian 720 nagyobb egymagos teljesítményt, sűrűbb magelrendezést és jobb energiahatékonyságot ígér, míg a Yitian 730 a T-Head saját mikroarchitektúrájára épül, és a közlés szerint akár 40 százalékkal magasabb SPECint2017/GHz teljesítményt nyújt a Yitian 710-hez képest.
Ügynöki felhő az AI-rendszerek skálázásához
Az Alibaba Cloud az ügynöki felhő stratégiáját három terület köré építi: a modellek, az ügynökök működtetéséhez szükséges eszközök és a kontextus köré. Ennek megfelelően az AI Native Cloud a nagy léptékű modellképzést és következtetést, az Agent Native Cloud a vállalati AI-ügynökök telepítését, működtetését és biztonságát, a Context Engine pedig a valós idejű adatokat és a hosszú távú memóriát szolgálja.
Az Alibaba Cloud Platform for AI rendszere következtetési, gyorsítótárazási, mintavisszajátszási és képzési szolgáltatásokat hangol össze. A vállalat szerint a Qwen-modellek valós utólagos képzése öt nap alatt zajlott le. A Cloud Parallel File Storage rendszer több száz terabájt másodpercenkénti áteresztőképességet és másodpercenként több százmillió bemeneti-kimeneti műveletet céloz, miközben az Alibaba szerint 69 százalékkal csökkentheti a vállalati AI-tárolás költségeit.
A HPN 8.0 Pro AI-hálózati architektúra 100 petabites sávszélességet és alacsony késleltetést kínál. Egy klaszter több mint 130 ezer, egyenként 800 gigabites hálózati portot támogathat. Az Alibaba emellett bemutatta az AgentCore vállalati platformot, amely AI-ügynökök teljes életciklusú létrehozását, futtatását és kezelését teszi lehetővé, beleértve az ember és az ügynök együttműködésének szabályozását és a teljesítmény megfigyelését.
A bejelentések alapján az Alibaba a modellek, az infrastruktúra és a felhasználói alkalmazások együttes fejlesztésével akarja támogatni az AI vállalati és mobiltelefonos használatát. A cég vezérigazgatója, Eddie Wu szerint az Alibaba Cloud által működtetett globális adatközponti kapacitás 2032-re meghaladhatja a 20 gigawattot.


