A Novita AI-ra érkezett a Qwen3.8 2.4T A95B, egymillió tokenes kontextussal

A Novita AI szerver nélküli API-ján elérhetővé tette a nyílt súlyú, csak szöveget kezelő Qwen3.8 2.4T A95B modellt. A rendszer egymillió tokenes kontextusablakot, 131 072 tokenes maximális kimenetet, valamint függvényhívást és strukturált kimeneteket kínál.
- A Qwen3.8 2.4T A95B nyílt súlyú, ritkított MoE modell.
- A Novita AI egymillió tokenes kontextusablakot és 131 072 tokenes maximális kimenetet listáz.
- A modell csak szöveges bemenetet és kimenetet támogat.
- Elérhető a függvényhívás, a strukturált kimenet és az érvelési támogatás.
- Az ár 2 dollár egymillió bemeneti tokenenként és 6 dollár egymillió kimeneti tokenenként.
Nagy modell, nyílt súlyokkal
A Novita AI augusztus 31-i közleménye szerint a Qwen3.8 2.4T A95B egy ritkított szakértői keverékmodell, vagyis sparse MoE rendszer. Összesen 2,4 billió paramétert tartalmaz, amelyek közül 95 milliárd aktív egy adott feldolgozás során.
A modell azonosítója a Novita AI felületén qwen/qwen3.8-2.4t-a95b. A szolgáltató szöveges bemenetet és szöveges kimenetet listáz, a modellt pedig hosszú kontextust igénylő programozási, kutatási és összetett érvelési feladatokra, valamint ügynöki munkafolyamatokra szánja.
A nyílt súlyú kialakítás lehetőséget ad arra, hogy a fejlesztőcsapatok a saját kiszolgálási és telepítési követelményeik mellett is kiértékeljék a modellt. A Qwen modellkártyája a modell súlyait és konfigurációs fájljait is dokumentálja, továbbá olyan kiszolgálókeretrendszerekkel való kompatibilitást említ, mint a vLLM és az SGLang.
Egymillió tokenes kontextus és API-funkciók
A Novita AI egymillió tokenben adja meg a kontextusablak méretét, a maximális kimenetet pedig 131 072 tokenben határozza meg. Ez a szolgáltató szerint alkalmassá teheti a modellt teljes kódtárak áttekintésére, nagyméretű kódellenőrzésre, több dokumentum együttes elemzésére és olyan ügynöki ciklusokra, amelyek eszközhasználati nyomokat vagy köztes állapotokat őriznek meg.
A szerver nélküli modell támogatja a függvényhívást, a strukturált kimeneteket és az érvelési módot. Az API a chat/completions és a responses végpontcsaládokat is támogatja. A Novita AI OpenAI-kompatibilis belépési pontja: https://api.novita.ai/openai.
A közölt ár a 2026. szeptember 2-án ellenőrzött adatok szerint 2 dollár egymillió bemeneti tokenenként, 0,25 dollár egymillió gyorsítótárból olvasott tokenenként és 6 dollár egymillió kimeneti tokenenként. A feltüntetett T1-es korlát 30 RPM és 50 000 000 TPM. A Novita AI szerint az árak és a limitek változhatnak.
Kinek lehet megfelelő a modell?
A Qwen3.8 2.4T A95B azoknak a csapatoknak lehet érdekes, amelyek nyílt súlyú modellt szeretnének használni, később saját infrastruktúrára költöznének, vagy ugyanazt a modell-artefaktumot több környezetben tartanák meg. A nagy kontextus miatt a hosszú kódolási feladatok, a tárházszintű elemzés és a többdokumentumos kutatás tartozik a kiemelt felhasználási területek közé.
A modell szöveges bemenetre korlátozódik, ezért a Novita AI nem ezt javasolja alapértelmezett választásként képi vagy látási feladatokhoz. Rövid osztályozásnál, egyszerű adatkinyerésnél és nagy mennyiségű, rövid kérésnél egy kisebb modell is elegendő lehet. A vállalat külön kezelt Qwen3.8-Max szolgáltatása olyan felhasználóknak szólhat, akik látási bemenetet vagy készebb, menedzselt munkafolyamatot keresnek.
A Qwen3.8 2.4T A95B tehát a nyílt súlyú hordozhatóságot és a szövegközpontú munkát helyezi előtérbe. A fejlesztők a Novita AI végpontján értékelhetik, majd saját kiszolgálási igényeikhez mérten dönthetnek a további telepítésről.
Novita AI: Qwen3.8 2.4T A95B on Novita AI: Open-Weight 1M-Context API


