Megjelent a Qwen3.8-2.4T-A95B, már a Modalon is elérhető

A Qwen3.8-2.4T-A95B nyílt súlyú modellként jelent meg, és már a Modal felhőplatformján is elérhető. A szolgáltató szerint az új modell több területen is javult a Qwen 3.7-hez képest.
- A Qwen3.8-2.4T-A95B nyílt súlyú modellként jelent meg.
- A modell már elérhető a Modal platformján és az Auto Endpointsben.
- A Modal SGLangot és Qwen3.8-hoz hangolt DFlash spekulátort használ.
- A modell kódolási, munkavégzési, kutatási és hosszú távú feladatokban javult a Qwen 3.7-hez képest.
- A szöveges változat egy hónapig használható OpenAI-kompatibilis Shared Endpointként.
Nyílt súlyú modellként indult
A Modal 2026. augusztus 12-i bejelentése szerint a Qwen3.8-2.4T-A95B már elérhető a platformon. A modell nyílt súlyúként jelent meg, így a fejlesztők a Modal környezetében is kipróbálhatják.
A szolgáltató közlése alapján az új modell a Qwen 3.7-hez képest jelentős javulást hoz a kódolási, munkavégzési, kutatási és hosszú távú feladatokban. A bejelentés ezekhez a területekhez kapcsolódó konkrét mérési eredményeket vagy pontszámokat nem közöl.
A Modal és a Qwen már a megjelenés előtt együtt dolgozott azon, hogy a modell az első napon támogatást kapjon a Modal Auto Endpoints szolgáltatásában. A futtatási háttérben az SGLang, valamint egy egyedi, a Qwen3.8 felépítéséhez hangolt DFlash spekulátor működik.
A gyorsabb következtetésre épít a DFlash
A modell elindítása önmagában nem garantál gyors működést, ezért a Modal a következtetés, vagyis az inference gyorsítására is külön megoldást használt. Ehhez ismét DFlash spekulátormodellt alkalmaztak.
A spekulátor előre elkészít bizonyos tokeneket, vagyis a modell által feldolgozott szövegegységeket. A megoldás akkor hasznos, ha a célmodell elfogadja ezeket a javaslatokat. Az elfogadás esélyét az befolyásolja, hogy a spekulátor korábban látott-e a megjósolt sorozatokhoz hasonló példákat.
A Modal közlése szerint a kódolási, kutatási és munkafeladatok javulása miatt ezeknél a feladatoknál nagyobb szerepet kapnak az eszközhívások. A vállalat ezért olyan tanítási adatokat használt, amelyek erre a működésre helyezik a hangsúlyt, hogy növeljék az elfogadott előrejelzések arányát.
Egy hónapig érhető el megosztott végponton
A Qwen3.8-2.4T-A95B szöveges változata a következő hónapban OpenAI-kompatibilis Shared Endpointként használható a Modalon. Ez olyan megosztott végpontot jelent, amelyhez tokenalapú díjazás kapcsolódik.
A Modal a bejelentésben nem közölt konkrét tokenenkénti árat. A szolgáltatás célja, hogy a fejlesztők a modell futtatását a platform meglévő végponti felületén próbálhassák ki, miközben a háttérben az SGLang és a Qwen3.8-hoz igazított DFlash spekulátor segíti a működést.
Felhasználói szempontból a bejelentés a modell gyors elérhetőségét emeli ki. A Qwen3.8-2.4T-A95B a megjelenés napjától támogatást kapott a Modal Auto Endpointsben, a szöveges változat pedig korlátozott ideig, egy hónapig érhető el a megosztott végponton.
Modal: Qwen3.8-2.4T-A95B now available on Modal


