Mesterséges intelligencia, magyarul.
Az eredeti közleményekből.

Képfeldolgozással bővült a DeepSeek V4 Flash a Novita AI-on

2026. szeptember 10.Forrás: Novita AI
Képfeldolgozással bővült a DeepSeek V4 Flash a Novita AI-on
Kép: Novita AI

A Novita AI elérhetővé tette a DeepSeek V4 Flash Vision Exp modellt, amely a DeepSeek V4 Flash 0731 szöveges képességei mellé képbemenetet kínál. A kísérleti változat képek, dokumentumok, diagramok és képernyőképek feldolgozására használható.

A lényeg röviden
  • A DeepSeek V4 Flash Vision Exp szöveges és képi bemenetet fogad.
  • A modell kísérleti változatként érhető el a Novita AI szerver nélküli API-ján.
  • A kontextusablak 1 048 576 tokenes, a maximális kimenet 393 216 token.
  • Az ár 0,44 dollár bemeneti és 1,32 dollár kimeneti tokenmilliónként.
  • A Novita AI nem közölt benchmarkeredményeket a Vision Exp változathoz.

Képek és szövegek feldolgozása egy modellben

A DeepSeek V4 Flash Vision Exp a DeepSeek V4 Flash család kísérleti, képfeldolgozásra képes tagja. A Novita AI leírása szerint a modell a DeepSeek V4 Flash 0731 szöveges képességeit, köztük az ügynöki feladatokat, a következtetést és a világismeretet a képek értelmezésével egészíti ki.

A hosztolt változat szöveges és képi bemenetet fogad, a kimenete szöveges. Ez olyan feladatoknál lehet hasznos, ahol a lényeg a dokumentum elrendezésében, egy diagram kapcsolatainak felismerésében, egy táblázatban vagy egy képernyőkép állapotában található.

A modell kísérleti jelölése fontos része a bejelentésnek. A Novita AI azt javasolja, hogy a fejlesztők saját tesztekkel ellenőrizzék a pontosságot, az eszközhasználatot, a késleltetést és a költségeket, mielőtt éles rendszerbe állítják.

API, képességek és korlátok

A szolgáltatás szerver nélküli API-ként érhető el a deepseek/deepseek-v4-flash-vision-exp modellazonosítóval. A Novita AI a chat/completions, az Anthropic-kompatibilis és a Responses végpontcsaládokat sorolja fel. A hosztolt modell támogatja a függvényhívást, a strukturált kimeneteket és a következtetést is.

A kontextusablak 1 048 576 tokenes, a maximális kimenet pedig 393 216 token lehet. A modell architektúrája Sparse MoE, összesen 284 milliárd, aktívan 13 milliárd paraméterrel. A katalógus alapértelmezett kvótája percenként 30 kérés, amelyet a Novita AI katalógusértékként kezel, nem garantált tényleges áteresztőképességként.

A platformkiadás dátuma 2026. augusztus 24. A modelloldal adatai szerint a szolgáltatás bemeneti ára 0,44 dollár 1 millió tokenenként, a kimeneti ár pedig 1,32 dollár 1 millió tokenenként. A gyorsítótárból olvasott tokenek ára 0,028 dollár 1 millió tokenenként.

Drágább a szöveges alapmodellnél

A Novita AI-on elérhető, csak szöveget kezelő DeepSeek V4 Flash bemeneti ára 0,14 dollár, kimeneti ára pedig 0,28 dollár 1 millió tokenenként. A két változat ugyanakkora, 1 048 576 tokenes kontextusablakot és 393 216 tokenes maximális kimenetet használ.

A Vision Exp változatnál ezért a képi bemenet támogatása jelenti a fő funkcionális különbséget, miközben a tokenárak magasabbak. Tisztán szöveges feladatokra a Novita AI a text-only alapmodellt jelöli közvetlenebb és olcsóbb választásként.

A Novita AI nem közölt benchmarkeredményeket a DeepSeek V4 Flash Vision Exp modelloldalán. Emiatt a DeepSeek V4 Flash korábbi teljesítményadatait nem lehet automatikusan erre a változatra vetíteni.

Elsősorban értékeléshez és vizuális ügynökökhöz

A modell használható dokumentumok és számlák áttekintésére, diagramok és műszerfalak értelmezésére, termék- vagy felületi képernyőképek elemzésére, valamint olyan ügynöki munkafolyamatokban, amelyek képi és szöveges adatokat, eszközhívást vagy strukturált kimenetet igényelnek.

A fejlesztőknek a valós feladatokhoz illeszkedő tesztkészletet érdemes létrehozniuk. A Novita AI külön kiemeli a képernyőképek és képalapú dokumentumok pontosságát, a strukturált kimenet érvényességét, a függvényhívások minőségét, a végponti késleltetést, a tokenfelhasználást, valamint az elutasítási, csonkolási, újrapróbálkozási és tartalékmodellre váltási arányokat.

A bevezetéshez a pontos modellazonosító használata, a multimodális üzenetformátum és a támogatott képfeltételek ellenőrzése szükséges. A Novita AI szerint a modelloldal az irányadó a képességek, limitek, kvóták és árak tekintetében, mivel ezek később külön is változhatnak.

Novita AIDeepSeek V4 Flash Vision ExpDeepSeek V4 Flash 0731nyelvi modellekmultimodális AIérvelő modellekvállalati AI

Kapcsolódó hírek

A Novita AI-ra érkezett a Xiaomi MiMo V2.6 Pro modellje
Termékek és eszközök2026. szeptember 30. 12:00

A Novita AI-ra érkezett a Xiaomi MiMo V2.6 Pro modellje

A Novita AI elérhetővé tette a Xiaomi MiMo V2.6 Pro modelljét serverless, OpenAI-kompatibilis chatmodellként. A rendszer szöveges, képi, videós és hangalapú bemenetet…

A Novita AI-ra megérkezett a Xiaomi MiMo V2.6 Pro modellje
Termékek és eszközök2026. szeptember 30. 12:00

A Novita AI-ra megérkezett a Xiaomi MiMo V2.6 Pro modellje

A Novita AI serverless, OpenAI-kompatibilis chatmodellként tette elérhetővé a Xiaomi MiMo V2.6 Pro modelljét. A rendszer szöveget, képet, videót és hangot is fogad…

Multimodális, egymillió tokenes modellel bővült a Novita AI kínálata
Modellek2026. szeptember 30.

Multimodális, egymillió tokenes modellel bővült a Novita AI kínálata

A Novita AI szerver nélküli API-kínálatában elérhetővé vált a MiMo V2.6 Flash, amely szöveges, képi, videós és hangalapú bemeneteket kezel. A modell 1 048 576 tokenes…