Mesterséges intelligencia, magyarul.
Az eredeti közleményekből.

A DeepSeek V4.1 Flash 1 milliós kontextussal érkezett a Novita AI-ra

2026. október 10. 12:00Forrás: Novita AI
A DeepSeek V4.1 Flash 1 milliós kontextussal érkezett a Novita AI-ra
Kép: Novita AI

A DeepSeek V4.1 Flash szerver nélküli API-ként elérhetővé vált a Novita AI platformján. Az új modell megtartja az 1 048 576 tokenes kontextusablakot, képeket is fogad, és a DeepSeek közzétett tesztjei szerint erősebb az ügynökalapú programozási feladatokban, mint a DeepSeek V4 Flash.

A lényeg röviden
  • A DeepSeek V4.1 Flash szerver nélküli API-ként elérhető a Novita AI-on.
  • A modell szöveget és képet fogad, kontextusablaka 1 048 576 tokenes.
  • A DeepSeek saját tesztjeiben javult a Terminal-Bench, a DeepSWE és az AutomationBench eredménye.
  • Az ár 0,3 dollár 1 millió bemeneti és 1,2 dollár 1 millió kimeneti tokenenként.
  • A meglévő Novita AI-integráció a modellazonosító cseréjével kipróbálható.

Nagyobb teljesítmény az ügynökalapú feladatokban

A Novita AI 2026. október 10-i tájékoztatása szerint a DeepSeek V4.1 Flash a DeepSeek V4 Flash utódja, és a deepseek/deepseek-v4.1-flash modellazonosítóval használható. Az API a Novita AI meglévő OpenAI-kompatibilis chat completions végpontján érhető el, emellett Anthropic-kompatibilis és Responses végpontcsaládot is támogat.

A DeepSeek saját, maximális gondolkodási erőfeszítés mellett végzett mérései alapján a modell több ügynökalapú teszten is javított. A Terminal-Bench 2.1 eredménye 90,6 lett a V4 Flash 82,7-es értékével szemben. A DeepSWE v1.1 teszten 74,2-t ért el, míg a V4 Flash 54,4-et, az AutomationBench Pass@1 eredménye pedig 54,8 volt a korábbi modell 37,7-ével szemben. A Novita AI hangsúlyozza, hogy ezek a DeepSeek saját mérési eredményei, ezért a fejlesztőknek saját feladataikon is ellenőrizniük kell a modellt.

Kép- és szövegbemenet, változatlanul egymillió tokenes kontextus

A DeepSeek V4.1 Flash szöveget és képet is képes feldolgozni, és szöveges választ ad. Ez lehetővé teszi például képernyőképek, grafikonok vagy dokumentumoldalak továbbítását a szöveges utasítással együtt. A DeepSeek V4 Flash ezzel szemben csak szöveges bemenetet fogadott.

A modell 1 048 576 tokenes kontextusablakot és legfeljebb 393 216 tokenes kimenetet támogat. A DeepSeek V4.1 Flash architektúrája 552 milliárd paraméteres alapmodellt és egy 196 milliárd paraméteres Engram feltételesmemória-modult használ, összesen nagyjából 748 milliárd paraméterrel.

A modell 40 rétegű transzformerre épül, amely egy 20 rétegű kauzális kódolóból és egy 20 rétegű dekóderből áll. A Novita AI szerint a KV-gyorsítótár mérete a DeepSeek V4 Flash értékének nagyjából negyedére csökken. Az aktív paraméterek száma előfeldolgozáskor 8 milliárd, dekódoláskor 16 milliárd, szemben a V4 Flash 13 milliárdos állandó értékével. Ez a modell kiszolgálásának hatékonyságát érintő architekturális változás, nem a Novita AI árengedménye.

Magasabb tokenár, meglévő integrációval

A Novita AI a DeepSeek V4.1 Flash használatáért 1 millió bemeneti tokenenként 0,3 dollárt, 1 millió kimeneti tokenenként pedig 1,2 dollárt számít fel. A gyorsítótárból olvasott tokenek ára 1 millió tokenenként 0,006 dollár. Ez magasabb a DeepSeek V4 Flash 0,14, illetve 0,28 dolláros bemeneti és kimeneti áránál, ugyanakkor alacsonyabb a V4 Flash 0731 revízió 0,44 és 1,32 dolláros díjánál.

A Novita AI szerint a meglévő integráció kipróbálásához elég a modellazonosítót lecserélni a jelenlegi alap URL és API-kulcs használata mellett. Képes kéréseknél a multimodális üzenetformátumot kell alkalmazni az aktuális API-dokumentáció alapján. A fejlesztőknek a teljes éles átállás előtt reprezentatív programozási, eszközhasználati és képfeldolgozási feladatokon kell tesztelniük a modellt, mivel a magasabb tokenár miatt a végső költség a forgalomtól függ.

Kövesd az AI Hírek oldalát a FacebookonA legfontosabb MI-hírek magyarul, rögtön a megjelenés után a hírfolyamodban.Követem

Kapcsolódó hírek

A Vercel AI Gatewayre került a Mistral Large 4
Termékek és eszközök2026. október 6.

A Vercel AI Gatewayre került a Mistral Large 4

A Vercel AI Gatewayen is elérhetővé vált a Mistral Large 4, a Mistral nyílt súlyú, natívan multimodális modellje. A szolgáltatás egyetlen API-kulccsal teszi…

A Baseten szerint 200 token/másodperc felett fut nála a GLM-5
Fejlesztőknek2026. október 2. 18:25

A Baseten szerint 200 token/másodperc felett fut nála a GLM-5

A Baseten állítása szerint a GLM-5 több mint 200 token/másodperces sebességet ért el a szolgáltatásán, miközben az első tokenig eltelt idő körülbelül 200 ezredmásodperc…

Élesben is elérhető a DeepSeek V4 Pro 0813 a Novita AI-on
Modellek2026. augusztus 17.

Élesben is elérhető a DeepSeek V4 Pro 0813 a Novita AI-on

A Novita AI éles kiadásként tette elérhetővé a DeepSeek V4 Pro 0813 modellt, amely 1 048 576 kontextustokent és legfeljebb 393 216 kimeneti tokent támogat. A szolgáltató…