Mesterséges intelligencia, magyarul.
Az eredeti közleményekből.

Megjelent a Qwen3.8-2.4T-A95B, már a Modalon is elérhető

2026. augusztus 12.Forrás: Modal
Megjelent a Qwen3.8-2.4T-A95B, már a Modalon is elérhető
Kép: Modal

A Qwen3.8-2.4T-A95B nyílt súlyú modellként jelent meg, és már a Modal felhőplatformján is elérhető. A szolgáltató szerint az új modell több területen is javult a Qwen 3.7-hez képest.

A lényeg röviden
  • A Qwen3.8-2.4T-A95B nyílt súlyú modellként jelent meg.
  • A modell már elérhető a Modal platformján és az Auto Endpointsben.
  • A Modal SGLangot és Qwen3.8-hoz hangolt DFlash spekulátort használ.
  • A modell kódolási, munkavégzési, kutatási és hosszú távú feladatokban javult a Qwen 3.7-hez képest.
  • A szöveges változat egy hónapig használható OpenAI-kompatibilis Shared Endpointként.

Nyílt súlyú modellként indult

A Modal 2026. augusztus 12-i bejelentése szerint a Qwen3.8-2.4T-A95B már elérhető a platformon. A modell nyílt súlyúként jelent meg, így a fejlesztők a Modal környezetében is kipróbálhatják.

A szolgáltató közlése alapján az új modell a Qwen 3.7-hez képest jelentős javulást hoz a kódolási, munkavégzési, kutatási és hosszú távú feladatokban. A bejelentés ezekhez a területekhez kapcsolódó konkrét mérési eredményeket vagy pontszámokat nem közöl.

A Modal és a Qwen már a megjelenés előtt együtt dolgozott azon, hogy a modell az első napon támogatást kapjon a Modal Auto Endpoints szolgáltatásában. A futtatási háttérben az SGLang, valamint egy egyedi, a Qwen3.8 felépítéséhez hangolt DFlash spekulátor működik.

A gyorsabb következtetésre épít a DFlash

A modell elindítása önmagában nem garantál gyors működést, ezért a Modal a következtetés, vagyis az inference gyorsítására is külön megoldást használt. Ehhez ismét DFlash spekulátormodellt alkalmaztak.

A spekulátor előre elkészít bizonyos tokeneket, vagyis a modell által feldolgozott szövegegységeket. A megoldás akkor hasznos, ha a célmodell elfogadja ezeket a javaslatokat. Az elfogadás esélyét az befolyásolja, hogy a spekulátor korábban látott-e a megjósolt sorozatokhoz hasonló példákat.

A Modal közlése szerint a kódolási, kutatási és munkafeladatok javulása miatt ezeknél a feladatoknál nagyobb szerepet kapnak az eszközhívások. A vállalat ezért olyan tanítási adatokat használt, amelyek erre a működésre helyezik a hangsúlyt, hogy növeljék az elfogadott előrejelzések arányát.

Egy hónapig érhető el megosztott végponton

A Qwen3.8-2.4T-A95B szöveges változata a következő hónapban OpenAI-kompatibilis Shared Endpointként használható a Modalon. Ez olyan megosztott végpontot jelent, amelyhez tokenalapú díjazás kapcsolódik.

A Modal a bejelentésben nem közölt konkrét tokenenkénti árat. A szolgáltatás célja, hogy a fejlesztők a modell futtatását a platform meglévő végponti felületén próbálhassák ki, miközben a háttérben az SGLang és a Qwen3.8-hoz igazított DFlash spekulátor segíti a működést.

Felhasználói szempontból a bejelentés a modell gyors elérhetőségét emeli ki. A Qwen3.8-2.4T-A95B a megjelenés napjától támogatást kapott a Modal Auto Endpointsben, a szöveges változat pedig korlátozott ideig, egy hónapig érhető el a megosztott végponton.

Kövesd az AI Hírek oldalát a FacebookonA legfontosabb MI-hírek magyarul, rögtön a megjelenés után a hírfolyamodban.Követem

Kapcsolódó hírek

Az MLPerf új benchmarkkal méri a nagy nyelvi modellek utótréningjét
Kutatás2026. szeptember 24. 16:50

Az MLPerf új benchmarkkal méri a nagy nyelvi modellek utótréningjét

Az MLPerf Training első alkalommal külön benchmarkkal méri a nagy nyelvi modellek utótréningjét. A teszt a Qwen 3.5 397B modellt szoftverfejlesztési feladatokon…

A Snowflake Cortex AI-ba érkezik a Kimi K3
Cégek és üzlet2026. szeptember 24. 19:02

A Snowflake Cortex AI-ba érkezik a Kimi K3

Privát előzetesben elérhetővé vált a Moonshot AI nyílt súlyú Kimi K3 modellje a Snowflake Cortex AI platformján. A vállalatok így saját feladataikon tesztelhetik a…

Új modellek és Sandbox-funkciók érkeztek a Modalhoz
Termékek és eszközök2026. szeptember 14.

Új modellek és Sandbox-funkciók érkeztek a Modalhoz

A Modal négy új, nyílt súlyú modell támogatását, több Sandbox-fejlesztést és költségkezelési eszközt jelentett be. A frissítések között nyilvános alfában elérhető…