Egymillió tokenes kontextussal érkezett a Qwen3.8-Max a Novitára

A Novita AI elérhetővé tette a Qwen3.8-Max modellt szerver nélküli API-ként, egymillió tokenes kontextusablakkal és legfeljebb 131 072 tokenes kimenettel. A szolgáltató elsősorban hosszú kontextusú kódolási ügynökökhöz, eszközhasználó asszisztensekhez és szöveges automatizálási folyamatokhoz ajánlja.
- A Novita AI szerver nélküli API-ként kínálja a Qwen3.8-Maxot.
- A modellazonosító: qwen/qwen3.8-max.
- A kontextusablak 1 000 000 token, a maximális kimenet 131 072 token.
- Az ár 2 dollár az input-, 0,25 dollár a cache-olvasási és 6 dollár az output-tokenek egymilliójára.
- A modell hosszú kontextusú kódolási és ügynöki munkafolyamatokhoz készült.
Nagy kontextus, OpenAI-kompatibilis hozzáférés
A Novita AI 2026. augusztus 4-én közzétett adatai szerint a Qwen3.8-Max a szolgáltató modellkönyvtárában érhető el. A modellazonosító qwen/qwen3.8-max, a hozzáférés pedig a Novita szerver nélküli API-ján keresztül történik.
Az OpenAI-kompatibilis API alapcíme https://api.novita.ai/openai, a modell pedig a chat/completions végpontcsaládon használható. Ez azoknak a fejlesztőcsapatoknak lehet praktikus, amelyek már OpenAI-kompatibilis kliensekkel dolgoznak, és egy hosztolt Qwen-modellt szeretnének kipróbálni saját következtetési infrastruktúra üzemeltetése nélkül.
A Novita által feltüntetett kontextusablak 1 000 000 tokenes, a maximális kimenet pedig 131 072 token. Ez olyan feladatoknál lehet fontos, amelyeknél egyszerre kell kezelni egy nagy kódtárat, hosszú hibajegy- és pull request-előzményeket, több dokumentumot vagy egy ügynöki folyamat korábbi eszközkimeneteit.
A Qwen3.8-Max árazása a Novita AI-on
A Novita AI jelenlegi listázása alapján a bemeneti tokenek ára 2 dollár egymillió tokenenként. A gyorsítótárból olvasott tokenekért 0,25 dollárt, a kimeneti tokenekért pedig 6 dollárt számít fel egymillió tokenenként.
A szolgáltató szerint az árak kiindulópontot adnak a hosszú kontextusú munkafolyamatok értékeléséhez, a tényleges költség azonban függ a kontextus méretétől, a kimenet hosszától, a gyorsítótár-találatok arányától, az újrapróbálkozásoktól és attól is, hogyan kezeli az ügynök az állapotot az egymást követő körökben.
A Novita külön jelzi, hogy az árak változhatnak, ezért éles bevezetés vagy ügyfélnek vállalt költség előtt az aktuális árlistát kell ellenőrizni.
Kinek lehet megfelelő a modell?
A Qwen3.8-Maxot a Novita hosszú kontextusú kódolási ügynökökhöz, kódtárszintű áttekintéshez, eszközöket használó asszisztensekhez és nagy állapotot kezelő, szöveges automatizálási folyamatokhoz pozicionálja. Tipikus példaként a szolgáltató a teljes kódtárak felülvizsgálatát, hosszú pull requestek összefoglalását, több nagy dokumentumon végzett kutatási feladatokat és sok köztes információt megőrző automatizálási ügynököket említi.
A nagy kontextus lehetővé teszi, hogy a fejlesztők kevesebb repository-állapotot, hibajegy-előzményt, architektúradokumentációt és tesztkimenetet vágjanak le minden modellhívás előtt. Ügynöki folyamatokban több hely maradhat az eszközhasználat nyomainak, memóriáinak és hosszú utasításainak.
Rövid, egyszerű lekérdezésekhez, könnyű osztályozáshoz vagy költségérzékeny, nagy volumenű következtetéshez a Novita szerint egy kisebb modell is megfelelőbb kiindulópont lehet. A Qwen3.8-Maxot elsősorban akkor érdemes tesztelni, ha a csapat már kontextuskorlátokba ütközik, vagy az ügynöki munkafolyamat megbízhatóságát javítja a nagyobb megőrzött állapot.
Novita AI: Qwen3.8-Max on Novita AI: 2.4T MoE, 1M Context, and Launch Pricing

