Qwen3.8 Flash érkezett a Novita AI-ra, multimodális API-ként

A Novita AI elérhetővé tette a Qwen3.8 Flash modellt szerver nélküli, multimodális API-ként. A modell a Qwen4 architektúra korai előzetese, 1 millió tokenes kontextusablakkal és 0,15 dolláros, egymillió bemeneti tokenenkénti árral.
- A Qwen3.8 Flash a Novita AI szerver nélküli API-ján érhető el.
- Szöveget, képet és videót fogad, kimenetként szöveget ad.
- A kontextusablak 1 000 000 token, a maximális kimenet 131 072 token.
- Az ár 0,15 dollár egymillió bemeneti tokenenként és 0,47 dollár egymillió kimeneti tokenenként.
- A modell 125 milliárd paraméterből 6 milliárdot aktivál tokenenként.
Nagy kapacitás, takarékosabb aktiválás
A Novita AI augusztus 27-i platformkiadásként listázza a Qwen3.8 Flash modellt, amelyet az Alibaba és a Qwen biztosít. A modell az qwen/qwen3.8-flash azonosítóval érhető el a Novita szerver nélküli API-ján.
A Qwen3.8 Flash összesen 125 milliárd paramétert tartalmaz, tokenenként azonban 6 milliárd aktivált paraméterrel dolgozik. A rendszer kevert szakértői architektúrát használ, amelyhez egy 51 milliárd paraméteres N-gram embedding komponens, valamint GDN és QSA hibrid figyelmi megoldás társul. A Novita ezt a Qwen4 architektúra korai előzeteseként pozicionálja, nem egyszerűen kisebb méretű modellként.
A gondolkodási mód alapértelmezés szerint engedélyezett a modelloldalon, de kikapcsolható, ha rövidebb vagy gyorsabb válaszokra van szükség. Ez a beállítási lehetőség a modell multimodális képességeivel együtt az API-s munkafolyamatok tesztelésére teszi alkalmassá.
Szöveget, képet és videót is fogad
A Qwen3.8 Flash bemenetként szöveget, képet és videót támogat, kimenetként szöveget ad. A Novita által megadott kontextusablak 1 000 000 token, a maximális kimenet pedig 131 072 token. A felület ezeket jelenleg 977K, illetve 128K értékként jeleníti meg, ezért a fejlesztőknek a tényleges, élő modelloldalt kell használniuk a korlátok ellenőrzéséhez.
A modell használható például képernyőképek és incidensjelentések együttes elemzésére, képeket tartalmazó dokumentumok feldolgozására vagy videókkal kapcsolatos kérdések megválaszolására. Az egymillió tokenes kontextus emellett lehetőséget ad nagyobb kódtárak, hibajegyek, eszköznaplók és műszaki dokumentumok együttes vizsgálatára.
A forrás szerint a videobemenet támogatása önmagában nem garantál meghatározott költséget vagy késleltetést minden videóformátum esetén. A fejlesztőknek reprezentatív klipekkel, képkockasebességgel, felbontással és kérdéstípusokkal kell tesztelniük a modellt.
Az árak és az elérés
A Novita AI augusztus 31-én ellenőrzött modelloldala szerint a Qwen3.8 Flash használata bemeneti tokenenként 0,15 dollárba kerül egymillió tokenenként. A gyorsítótárból olvasott bemeneti tokenek díja 0,016 dollár, a kimeneti tokeneké pedig 0,47 dollár egymillió tokenenként.
A gyorsítótáras ár olyan esetekben lehet fontos, amikor az alkalmazás ismételten elküldi ugyanazokat a rendszerutasításokat vagy hosszú, változatlan háttéranyagokat. A tényleges számlázást azonban a Novita aktuális fiók- és díjszabási felületein kell ellenőrizni, az árakat pedig nem ajánlott közvetlenül számlázási rendszerbe beégetni.
A modell a Novita API-ján érhető el. OpenAI-kompatibilis kliensekhez a megadott alap URL: https://api.novita.ai/openai. A modelloldal a chat/completions, Anthropic és Responses végpontcsaládokat is felsorolja. A Novita szerint elsőként rövid, szöveges kéréssel célszerű tesztelni a kapcsolatot, majd fokozatosan hozzáadni a képi és videós bemenetet, miközben a tokenhasználatot is mérik.
A Qwen3.8 Flash elsősorban azoknak a csapatoknak lehet releváns, amelyek hosszú kontextust és többféle bemeneti formátumot szeretnének egy API-n keresztül kipróbálni. Rövid, kizárólag szöveges feladatokhoz a forrás kisebb modellt javasol tesztelni, a legnagyobb Qwen3.8 kapacitást keresőknek pedig a Qwen3.8 Max összehasonlítását ajánlja.
Novita AI: Qwen3.8 Flash on Novita AI: Multimodal API From $0.15/M Input


