DeepSeek

Az olcsóbb működéshez önmagában nem elég a promptok gyorsítótárazása
A promptok gyorsítótárazása csökkentheti az ismétlődő bemenetek feldolgozásának költségét, de az Arize AI tesztje szerint a magas cache újraolvasási arány önmagában nem…

A Baseten szerint 200 token/másodperc felett fut nála a GLM-5
A Baseten állítása szerint a GLM-5 több mint 200 token/másodperces sebességet ért el a szolgáltatásán, miközben az első tokenig eltelt idő körülbelül 200 ezredmásodperc…

A mesterséges intelligencia felgyorsíthatja a fiatalok radikalizációját
A mesterséges intelligencia felgyorsíthatja a fiatalok online radikalizációját, miközben szélsőséges csoportok már propagandagyártásra és támadások előkészítésére is…
Biztonság és etikaA FAR.AI szerint a Qoder kiberbiztonsági védelme megkerülhető
A FAR.AI kutatói szerint egy adaptív, projektmemóriára épülő támadással a Qoder parancssoros eszközét vezérlő modellek 30 káros kiberbiztonsági kérésből 27-30 esetben…
Biztonság és etikaA Qoder kiberbiztonsági védelme 30 támadásból akár 30 esetben megkerülhető volt
A FAR.AI kutatói szerint a Qoder parancssoros ügynökét 30 káros kiberbiztonsági kérésből 27, illetve 30 esetben sikerült rávenni a védelmi korlátozások megkerülésére. A…
KutatásA Jev kiválthatja az LLM-es bírákat? Az MLflow tesztelte
A TypeSafe Jev modellje 30 MLflow-val kapcsolatos kérdés mindegyikén egyezett az emberi értékeléssel, miközben a tesztben ez volt a leggyorsabb és legolcsóbb bíró. A…

A vLLM DSpark modellel négyszeresére nőtt a Kimi K3 sebessége
A vLLM Project új DSpark spekulátorral gyorsította fel a 2,8 billió paraméteres Kimi K3 modell kiszolgálását. A vállalat mérése szerint a matematikai feladatoknál az…

A RunPod szerint a DeepSeek R1 0528 több egy kisebb frissítésnél
A RunPod „The 'Minor Upgrade' That’s Anything But: DeepSeek R1 0528 Deep Dive” című anyagában azt sugallja, hogy a DeepSeek R1 0528 a nevében szereplő kisebb…

Kína állami eszközzé formálhatja a nyílt súlyú AI-modelleket
Kína nyíltan letölthető AI-modelljei egyre több külföldi fejlesztés alapjául szolgálnak, miközben Peking nemzetközi szervezetet és szabályozási kereteket épít a…

A hárombilliós modellek miatt új memóriamegoldásokra van szükség
A legfejlettebb mesterségesintelligencia-modellek már jóval meghaladják az 1 billió paramétert, ami új memóriamegoldásokat követel. A d-Matrix szerint a 3D-ben egymásra…

A DeepSeek API ára mostantól attól is függ, mikor használják
A DeepSeek API-kulcs létrehozása néhány lépésből áll, maga a kulcs pedig ingyenes. A használat díja azonban 2026. augusztus 16. óta időfüggő: a csúcsidős árak kétszer…

Ausztrália az AI-versenyben a szakértő emberekre építene
Ausztráliának az adatközpontok építése mellett a kutatókat, mérnököket és más AI-szakértőket kell előtérbe helyeznie, hogy valódi értéket teremtsen a mesterséges…

Élesben is elérhető a DeepSeek V4 Pro 0813 a Novita AI-on
A Novita AI éles kiadásként tette elérhetővé a DeepSeek V4 Pro 0813 modellt, amely 1 048 576 kontextustokent és legfeljebb 393 216 kimeneti tokent támogat. A szolgáltató…

A DeepSeek megelőzte a Google-t az AI-tokenek forgalmában
A DeepSeek júliusban a második legnagyobb laboratóriummá vált a Vercel AI Gateway forgalmában, és több mint kétszer akkora tokenmennyiséget kezelt, mint a Google. Közben…
Cégek és üzletAz ENSZ első AI-kormányzási párbeszéde után már a megvalósítás a tét
Az AI előnyeinek kiaknázása és a határokon átnyúló kockázatok kezelése egyszerre jelent meg az ENSZ első globális AI-kormányzási párbeszédén. A Simon Institute for…