Mesterséges intelligencia, magyarul.
Az eredeti közleményekből.

Élesben is elérhető a DeepSeek V4 Pro 0813 a Novita AI-on

2026. augusztus 17.Forrás: Novita AI
Élesben is elérhető a DeepSeek V4 Pro 0813 a Novita AI-on
Kép: Novita AI

A Novita AI éles kiadásként tette elérhetővé a DeepSeek V4 Pro 0813 modellt, amely 1 048 576 kontextustokent és legfeljebb 393 216 kimeneti tokent támogat. A szolgáltató új modellazonosítót, DSpark dekódolási modult és frissített árakat is megadott.

A lényeg röviden
  • A DeepSeek V4 Pro 0813 a Novita AI éles, hivatalos kiadása.
  • A modell 1 048 576 kontextustokent és 393 216 maximális kimeneti tokent támogat.
  • A 0813-as változat DSpark spekulatív dekódolási modult kapott.
  • Az ár 1,32 dollár egymillió bemeneti és 3,96 dollár egymillió kimeneti tokenenként.
  • A Novita AI a Flash modellt alapforgalomhoz, a Pro 0813-at nehezebb feladatokhoz ajánlja.

A DeepSeek V4 Pro 0813 a gyártási kiadás

A Novita AI 2026. augusztus 17-i közleménye szerint a DeepSeek V4 Pro 0813 a DeepSeek V4 Pro gyártási, vagyis éles kiadása a platformon. A modell azonosítója deepseek/deepseek-v4-pro-0813, és OpenAI-kompatibilis hozzáférést kínál a https://api.novita.ai/openai címen.

A Novita AI modelloldala szerint a szolgáltatás szerver nélküli kiszolgálást, függvényhívást, strukturált kimeneteket és következtetési támogatást is biztosít. A modell kontextusablaka 1 048 576 tokenes, a maximális kimenet pedig 393 216 token lehet.

A DeepSeek változásnaplója alapján a V4 modellcsalád hivatalos kiadása augusztus 13-án történt, az árváltozások pedig augusztus 16-án, koordinált világidő szerint léptek életbe. A Hugging Face modellen található kártya szintén hivatalos kiadásként jelöli a DeepSeek-V4-Pro-0813-at, és MIT licencet tüntet fel.

DSpark modul segíti a dekódolást

A hivatalos modellkártya szerint a 0813-as kiadás a korábbi előzetes struktúrához képest egy DSpark spekulatív dekódolási modult ad a rendszerhez. A Novita AI leírása szerint ez olyan kiszolgálási útvonalat jelent, amelynek célja a kimenet összehangolása a dekódolás hatékonyságának javítása mellett.

Ennek azoknál a csapatoknál lehet jelentősége, amelyek már DeepSeek V4 Pro modellt használnak ügynöki kódoláshoz vagy hosszú kontextusú következtetéshez. A szolgáltató kiemeli, hogy a 0813-as változatot szánják éles használatra, ezért a korábbi előzetes útmutatókra épülő kiadási státusz és árképzés már nem tekinthető aktuálisnak.

A Novita AI kapcsolódó útmutatói továbbra is használhatók a DeepSeek V4 Pro hosszú kontextusú kéréseinek kialakításához, illetve a DeepSeek V4 Pro és a Flash közötti forgalomirányítási döntésekhez.

Frissült az árképzés és a hozzáférés

A Novita AI modelloldalán feltüntetett jelenlegi díjak szövegbemenet esetén 1,32 dollár egymillió tokenenként, a gyorsítótárból olvasott bemenetnél 0,35 dollár egymillió tokenenként, kimenetnél pedig 3,96 dollár egymillió tokenenként. A szolgáltató arra figyelmeztet, hogy a korábbi DeepSeek V4 Pro-cikkek előzetes időszakból származó árait nem szabad a mostani tervezéshez használni.

A végpontcsaládok között a chat/completions, a responses és az anthropic szerepel. Az OpenAI Python-kliensével a Novita AI API-végpontján keresztül lehet elindulni, a modellparaméterként pedig a deepseek/deepseek-v4-pro-0813 azonosítót kell megadni.

A Novita AI ajánlása szerint a DeepSeek V4 Pro 0813 kódolási, tervezési és hosszú kontextust igénylő feladatokra használható. Ha egy csapat a Pro és a Flash között választ, a szolgáltató a Flash használatát javasolja az alapforgalomhoz, míg a Pro 0813-at a nehezebb, hosszú kontextusú vagy nagyobb hibaköltséggel járó kérésekhez tartja megfelelőnek.

Kövesd az AI Hírek oldalát a FacebookonA legfontosabb MI-hírek magyarul, rögtön a megjelenés után a hírfolyamodban.Követem

Kapcsolódó hírek

A Baseten szerint 200 token/másodperc felett fut nála a GLM-5
Fejlesztőknek2026. október 2. 18:25

A Baseten szerint 200 token/másodperc felett fut nála a GLM-5

A Baseten állítása szerint a GLM-5 több mint 200 token/másodperces sebességet ért el a szolgáltatásán, miközben az első tokenig eltelt idő körülbelül 200 ezredmásodperc…

A Snowflake Cortex AI-ba érkezik a Kimi K3
Cégek és üzlet2026. szeptember 24. 19:02

A Snowflake Cortex AI-ba érkezik a Kimi K3

Privát előzetesben elérhetővé vált a Moonshot AI nyílt súlyú Kimi K3 modellje a Snowflake Cortex AI platformján. A vállalatok így saját feladataikon tesztelhetik a…

Tencent Hy4 Preview: egymillió tokenes MoE-modell érkezett a Novitára
Modellek2026. szeptember 20.

Tencent Hy4 Preview: egymillió tokenes MoE-modell érkezett a Novitára

A Novita AI szerver nélküli szöveges API-ként tette elérhetővé a Tencent Hy4 Preview modellt. A 770 milliárd paraméteres, szakértőkeverék-alapú rendszer egymillió…