nyelvi modellek

NeoMME néven többnyelvű multimodális enkódercsalád jelent meg
A Hugging Face közösségi blogján 2026. szeptember 3-án jelent meg a NeoMME bemutatója. A bejegyzés egy 260M és 800M méretű, multimodális-natív, többnyelvű…
ModellekAz OpenAI bemutatta a GPT-6 Astrát, új csúcsmodelljét munkára és kódolásra
Az OpenAI 2026. szeptember 3-án bemutatta a GPT-6 Astrát, amelyet a vállalat a világ legintelligensebb és leginkább összehangolt modelljeként ír le. A modell korlátozott…

Hugging Face: 350M modellt finomhangoltak strukturált kimenetekhez
A Hugging Face 2026. szeptember 3-án megjelent blogbejegyzése egy 350M méretű modell finomhangolását mutatja be strukturáltabb szövegkimenetekhez. A cím szerint a…
Biztonság és etikaOpenAI: a GPT-6 Astra elérte a kritikus kiberképességi szintet
Az OpenAI 2026. szeptember 3-án közzétette a GPT-6 Astra biztonsági áttekintését, és bejelentette a modell széles körű bevezetését. A cég szerint ez az eddigi legnagyobb…

Az Anaconda szerint a fejlesztőknek szabadon választható modellek kellenek
A Cursor és az OpenAI közötti hozzáférés megszűnése az Anaconda szerint megmutatja, milyen kockázatot jelent, ha egy fejlesztői eszköz modellhozzáférése egyetlen üzleti…

Megjelent a Gemini 3.8 Flash és a kiberbiztonsági 3.8 Flash Cyber
A Google DeepMind 2026. szeptember 2-án bemutatta a Gemini 3.8 Flash és a Gemini 3.8 Flash Cyber modelleket. A vállalat szerint az új kiadás a 3.7 Flash sebessége és…

NVIDIA: öt irányelv gyorsíthatja az LLM-ek spekulatív dekódolását
Az NVIDIA Developer 2026. szeptember 2-án közölt technikai útmutatót arról, hogyan gyorsítható az LLM-inferencia spekulatív dekódolással. A bejegyzés öt irányelvet ad a…

A mesterséges intelligencia felgyorsítja a szoftverellátási lánc támadásait
A mesterséges intelligenciával támogatott támadások felgyorsítják a szoftveres sérülékenységek kihasználását, miközben az npm-ben egy év alatt 451 százalékkal nőtt a…

Kételkedni tanították az AI-t, hogy jobb kísérleteket válasszon
Az EPFL kutatói olyan módszert fejlesztettek, amely egy nagy nyelvi modellt bizonytalanságérzékelővel kapcsol össze, hogy hatékonyabban válassza ki a tudományos…

A Fable 5.1 gyorsabb és takarékosabb, de az Opus 5 megbízhatóbb
A Fable 5.1 a sikeres futások során 58 százalékkal kevesebb kimeneti tokent használt, és 36 százalékkal gyorsabban végzett, mint az Opus 5. A Snorkel AI értékelése…

Elérhető a Meta Muse Spark 1.3 modellje a Vercel AI Gatewayen
A Vercel AI Gatewayen elérhetővé vált a Meta Muse Spark 1.3 modellje, amelyet ügynökalapú feladatokra és programozásra fejlesztettek tovább. A modell egymillió tokenes…

Féláron érhető el a GLM-5.3 a Vercel AI Gateway rendszerében
Szeptember 8-ig 50 százalékos kedvezménnyel használható a GLM-5.3 a Vercel AI Gateway rendszerében a DigitalOcean közreműködésével. Az akcióhoz külön modellnevet kell…

A Vercel AI Gatewayre érkezett a Gemini 3.8 Flash
A Google Gemini 3.8 Flash modellje elérhetővé vált a Vercel AI Gateway szolgáltatásán. A modell december 31-ig 50 százalékos kedvezménnyel használható, és akár 1 millió…

BenchMIRT címmel jelent meg bejegyzés az LLM-benchmarkokról
A Hugging Face-en 2026. szeptember 1-jén jelent meg a „BenchMIRT: What are LLM benchmarks actually measuring?” című bejegyzés. A cím alapján a cikk központi kérdése az…
Google: augusztusban jött a Gemini 3.7 Flash és a Pixel 11 sorozat
A Google 2026. szeptember 1-jén összefoglalta augusztusi AI-bejelentéseit. A lista új Gemini-modelleket, Pixel 11 készülékeket, oktatási funkciókat, videógenerálást és…
ModellekAz OpenAI kritikus kiberképességűnek minősítette az Astra modellt
Az OpenAI 2026. szeptember 1-jén közölte, hogy az Astra elérte a vállalat Preparedness Framework nevű biztonsági keretrendszerében meghatározott kritikus kiberbiztonsági…
Termékek és eszközökAz OpenAI szerint így skálázza az AI-t a Gilbert + Tobin ügyvédi iroda
Az OpenAI 2026. szeptember 1-jén bemutatta, hogyan vezette be a Gilbert + Tobin ausztrál ügyvédi iroda a ChatGPT Enterprise és a Codex használatát. A cég először…

Az Ai2 új módszere megmutatná, mit mérnek valójában az LLM-tesztek
Az Ai2 2026. szeptember 1-jén bemutatta a BenchMIRT nevű módszert, amellyel az LLM-benchmarkokat az egyes kérdések és feladatok szintjén lehet auditálni. A cél annak…

Elérhető a Harvey ügyfeleinek az Anthropic Fable 5.1 modellje
A Harvey ügyfelei bekapcsolhatják az Anthropic legújabb modelljét, a Fable 5.1-et. A vállalat korai tesztjei szerint a modell összetett, dokumentumközpontú elemzésekben…

A Vercel AI Gatewayre érkezett a Qwen 3.8 Max 0902
Elérhetővé vált a Vercel AI Gatewayen az Alibaba Qwen 3.8 Max 0902 modellje. Az új snapshotot elsősorban nagyobb kódolási projektekhez, felügyelet nélkül futó hosszú…

Elérhetővé vált az Anthropic Claude Fable 5.1 modellje a Vercel AI Gatewayen
A Vercel AI Gatewayen elérhetővé vált az Anthropic Claude Fable 5.1 modellje. A vállalat szerint a modell fejlesztései főként a hosszú, több lépésből álló feladatokra…

A tokenköltséget nem mindig az olcsóbb modell csökkenti
Az AI-modellek tokenenkénti ára önmagában félrevezető lehet. A Writer szerint a teljes feladatköltséget gyakran inkább az dönti el, milyen hatékonyan működik a modell…

A hárombilliós modellek miatt új memóriamegoldásokra van szükség
A legfejlettebb mesterségesintelligencia-modellek már jóval meghaladják az 1 billió paramétert, ami új memóriamegoldásokat követel. A d-Matrix szerint a 3D-ben egymásra…

Általánosan elérhetővé tette Training API-ját a Fireworks AI
Általánosan elérhetővé vált a Fireworks AI Training API-ja, amely egyedi tanítási ciklusokat kapcsol a vállalat elosztott tanítási és modellfuttatási…