Mesterséges intelligencia, magyarul.
Az eredeti közleményekből.

A Novita AI-ra érkezett a Qwen3.8 2.4T A95B, egymillió tokenes kontextussal

2026. augusztus 31.Forrás: Novita AI
A Novita AI-ra érkezett a Qwen3.8 2.4T A95B, egymillió tokenes kontextussal
Kép: Novita AI

A Novita AI szerver nélküli API-ján elérhetővé tette a nyílt súlyú, csak szöveget kezelő Qwen3.8 2.4T A95B modellt. A rendszer egymillió tokenes kontextusablakot, 131 072 tokenes maximális kimenetet, valamint függvényhívást és strukturált kimeneteket kínál.

A lényeg röviden
  • A Qwen3.8 2.4T A95B nyílt súlyú, ritkított MoE modell.
  • A Novita AI egymillió tokenes kontextusablakot és 131 072 tokenes maximális kimenetet listáz.
  • A modell csak szöveges bemenetet és kimenetet támogat.
  • Elérhető a függvényhívás, a strukturált kimenet és az érvelési támogatás.
  • Az ár 2 dollár egymillió bemeneti tokenenként és 6 dollár egymillió kimeneti tokenenként.

Nagy modell, nyílt súlyokkal

A Novita AI augusztus 31-i közleménye szerint a Qwen3.8 2.4T A95B egy ritkított szakértői keverékmodell, vagyis sparse MoE rendszer. Összesen 2,4 billió paramétert tartalmaz, amelyek közül 95 milliárd aktív egy adott feldolgozás során.

A modell azonosítója a Novita AI felületén qwen/qwen3.8-2.4t-a95b. A szolgáltató szöveges bemenetet és szöveges kimenetet listáz, a modellt pedig hosszú kontextust igénylő programozási, kutatási és összetett érvelési feladatokra, valamint ügynöki munkafolyamatokra szánja.

A nyílt súlyú kialakítás lehetőséget ad arra, hogy a fejlesztőcsapatok a saját kiszolgálási és telepítési követelményeik mellett is kiértékeljék a modellt. A Qwen modellkártyája a modell súlyait és konfigurációs fájljait is dokumentálja, továbbá olyan kiszolgálókeretrendszerekkel való kompatibilitást említ, mint a vLLM és az SGLang.

Egymillió tokenes kontextus és API-funkciók

A Novita AI egymillió tokenben adja meg a kontextusablak méretét, a maximális kimenetet pedig 131 072 tokenben határozza meg. Ez a szolgáltató szerint alkalmassá teheti a modellt teljes kódtárak áttekintésére, nagyméretű kódellenőrzésre, több dokumentum együttes elemzésére és olyan ügynöki ciklusokra, amelyek eszközhasználati nyomokat vagy köztes állapotokat őriznek meg.

A szerver nélküli modell támogatja a függvényhívást, a strukturált kimeneteket és az érvelési módot. Az API a chat/completions és a responses végpontcsaládokat is támogatja. A Novita AI OpenAI-kompatibilis belépési pontja: https://api.novita.ai/openai.

A közölt ár a 2026. szeptember 2-án ellenőrzött adatok szerint 2 dollár egymillió bemeneti tokenenként, 0,25 dollár egymillió gyorsítótárból olvasott tokenenként és 6 dollár egymillió kimeneti tokenenként. A feltüntetett T1-es korlát 30 RPM és 50 000 000 TPM. A Novita AI szerint az árak és a limitek változhatnak.

Kinek lehet megfelelő a modell?

A Qwen3.8 2.4T A95B azoknak a csapatoknak lehet érdekes, amelyek nyílt súlyú modellt szeretnének használni, később saját infrastruktúrára költöznének, vagy ugyanazt a modell-artefaktumot több környezetben tartanák meg. A nagy kontextus miatt a hosszú kódolási feladatok, a tárházszintű elemzés és a többdokumentumos kutatás tartozik a kiemelt felhasználási területek közé.

A modell szöveges bemenetre korlátozódik, ezért a Novita AI nem ezt javasolja alapértelmezett választásként képi vagy látási feladatokhoz. Rövid osztályozásnál, egyszerű adatkinyerésnél és nagy mennyiségű, rövid kérésnél egy kisebb modell is elegendő lehet. A vállalat külön kezelt Qwen3.8-Max szolgáltatása olyan felhasználóknak szólhat, akik látási bemenetet vagy készebb, menedzselt munkafolyamatot keresnek.

A Qwen3.8 2.4T A95B tehát a nyílt súlyú hordozhatóságot és a szövegközpontú munkát helyezi előtérbe. A fejlesztők a Novita AI végpontján értékelhetik, majd saját kiszolgálási igényeikhez mérten dönthetnek a további telepítésről.

Kapcsolódó hírek

256 ezres kontextusablakkal érkezett az Apodex 1.1 Mini a Novitára
Modellek2026. október 1.

256 ezres kontextusablakkal érkezett az Apodex 1.1 Mini a Novitára

A Novita AI OpenAI-kompatibilis API-n keresztül kínálja az Apodex 1.1 Minit, amely 262 144 tokenes, vagyis 256K-s kontextusablakkal dolgozik. A szolgáltató 2026. október…

Tencent Hy4 Preview: egymillió tokenes MoE-modell érkezett a Novitára
Modellek2026. szeptember 20.

Tencent Hy4 Preview: egymillió tokenes MoE-modell érkezett a Novitára

A Novita AI szerver nélküli szöveges API-ként tette elérhetővé a Tencent Hy4 Preview modellt. A 770 milliárd paraméteres, szakértőkeverék-alapú rendszer egymillió…

A Novita AI új INT4 MoE-kernelt nyílt forráskódúvá tett a Kimi K2.x-hez
Fejlesztőknek2026. szeptember 15.

A Novita AI új INT4 MoE-kernelt nyílt forráskódúvá tett a Kimi K2.x-hez

A Novita AI nyílt forráskódúvá tette a Chord nevű, INT4 súlyokkal működő MoE CUDA-operátort, amelyet a Kimi K2.x kiszolgálási formáihoz fejlesztettek. A vLLM mérései…