nyelvi modellek

Goodfire az Ai2 nyílt tréningrendszerével keresett hibát az Olmo viselkedésében
Az Ai2 2026. szeptember 9-én közölte, hogy a Goodfire interpretálhatósági kutatócég az Ai2 teljesen nyílt utótréning-rendszerét használta az Olmo nem kívánt…

Képfeldolgozással érkezett a DeepSeek V4.1 Flash a Vercel AI Gatewaybe
Elérhetővé vált a DeepSeek V4.1 Flash a Vercel AI Gateway szolgáltatásában, natív képfeldolgozással és egymillió tokenes kontextusablakkal. A modell szöveget és képeket…

A Novita AI-ra érkezett a Ling-3.0-Flash-VL multimodális modell
A Novita AI szerver nélküli végpontként kínálja a Ling-3.0-Flash-VL multimodális modellt, amely egyetlen API-munkafolyamatban kezel szöveges, képi és videós bemenetet. A…
ModellekOpenAI: a GPT-6 Astra új munkákat tehet gazdaságosan elérhetővé
Az OpenAI 2026. szeptember 8-án közzétett bejegyzésében azt állítja, hogy a GPT-6 Astra jelentős előrelépés az AI-képességekben. A cég szerint a fogyasztói és vállalati…

Az SAP szerint új pénzügyi kihívást jelent az AI tokenfogyasztása
A generatív mesterséges intelligencia terjedésével az AI-tokenek fogyasztása önálló vállalati költségkategóriává válik. Az SAP szerint a pénzügyi vezetőknek úgy kell…
KutatásOpenAI: belső AI-rendszer oldotta meg a Navier-Stokes-problémát
Az OpenAI 2026. szeptember 8-án közölte, hogy belső AI-rendszere megoldást készített a Navier-Stokes létezési és simasági problémára. A cég szerint a bizonyítás azt…

A Pydantic szerint az AI-k egymástól tanulják a furcsa szavakat
A Pydantic szerint a frontier modellek egyre gyakrabban használnak olyan kifejezéseket, amelyek korábban ritkák vagy szokatlanok voltak a fejlesztők számára. A cég ezt…

Cohere megakerneles kiszolgálót mutatott be a North Mini Code modellhez
A Cohere 2026. szeptember 8-án bemutatta a North Mini Code modellhez készült kiszolgáló motorját, amely egy dekódolási megakernelre épül. A cég szerint a rendszer BF16…

A vLLM új módszere 1 millió tokenes GLM 5.3 futtatást tesz lehetővé
A vLLM bemutatta a Hybrid HiSparse nevű memóriakezelési módszert, amellyel a GLM 5.3 egyetlen, 8× H200 GPU-ból álló gépen is futtatható teljes, 1 millió tokenes…

Harvey: az RLM-harness 39,1 százalékponttal javította az M&A-elemzést
A Harvey és a Baseten olyan rekurzív nyelvimodell-harnesszt fejlesztett az M&A-átvilágításhoz, amely a vállalat szerint jelentősen javította a dokumentumintenzív jogi…

A GitLabon elérhető a GPT-6 Astra, gyorsabban fut és kevesebb tokent használ
Elérhetővé vált a GPT-6 Astra a GitLab Duo Agent Platformon. A GitLab belső tesztje szerint a modell tipikus futása 43,4 százalékkal gyorsabb volt a GPT-5.6 Solénál…

Interaktív játékban mutatták be az LLM-alapú viselkedésszimulációt
Interaktív online játékkal mutatták be az ADM+S kutatói, hogyan használhatók a nagy nyelvi modellek a felhasználói viselkedés szimulációjára. A résztvevők egy…

A vLLM Tenstorrent-támogatást kapott, a GPU-któl eltérő működéssel
A vLLM új pluginje Tenstorrent gyorsítókat kapcsol be a nagy nyelvi modellek kiszolgálásába. A fejlesztés megtartja a vLLM OpenAI-kompatibilis felületét, miközben a…

Fable 5.1: olcsóbb lett, de nem minden feladaton
A Fable 5.1 gyorsítótárból történő olvasása 75 százalékkal olcsóbb lett a Fable 5-höz képest, a modell azonban több kimeneti tokent használ. Emiatt az ár attól függ…
Biztonság és etikaOpenAI-kutató: rendkívüli óvatosság kell a gyorsuló gépi intelligencia miatt
Az OpenAI 2026. szeptember 6-án „An Alien Mind” címmel közölt írást a következtető nyelvi modellek gyors fejlődéséről és kockázatairól. A szerző szerint a gépi…

NVIDIA: a Jetson már helyben futtat kompakt érvelő AI-modelleket
Az NVIDIA Developer 2026. szeptember 4-én bemutatta, hogyan telepíthetők és optimalizálhatók új, kompakt érvelő modellek NVIDIA Jetson eszközökön. A cég példaként a…

A GitHub bemutatta a Project HydraFusion kutatási előzetesét
A GitHub 2026. szeptember 4-én bemutatta a Project HydraFusion nevű kutatási előzetest. A rendszer a GitHub Copilotban több szolgáltató modelljei közül választ, és futás…
Cégek és üzletSatya Nadella: korai ügyfelek már használják az Astrát Azure-on
Satya Nadella, a Microsoft elnök-vezérigazgatója 2026. szeptember 4-én a LinkedInen azt írta, hogy korai ügyfelek már használják az Astrát Azure-on. A bejegyzés további…

A GPT-6 Astra általánosan elérhető a Microsoft Foundryban
A Microsoft szeptember 3-án közölte, hogy az OpenAI új frontier modellje, a GPT-6 Astra általánosan elérhető minden ügyfél számára a Microsoft Foundryban. A modell…

A Vercel AI Gatewayre érkezett az OpenAI GPT 6 Astra modellje
A Vercel AI Gatewayen elérhetővé vált az OpenAI GPT 6 Astra modellje, amelyet hosszú ideig futó, ügynöki feladatok végrehajtására terveztek. A modell szoftverekben…

Ingyen elérhető a Ling 3.0 Flash Sante a Vercel AI Gateway-en
A Vercel AI Gateway-en elérhetővé vált az inclusionAI egészségügyi feladatokra készült Ling 3.0 Flash Sante modellje. A szolgáltatás október 4-ig ingyenesen használható…

Ingyenes, orvosi fókuszú API-val bővült a Novita AI kínálata
A Novita AI elérhetővé tette a Ling-3.0-Flash-Sante modellt, amelyet orvosi szöveges munkafolyamatokhoz és fejlesztői értékelésekhez szánnak. A szerver nélküli API…

Elérhető a GPT-6 Astra a Microsoft Foundryban
A Microsoft Foundry minden ügyfele számára elérhetővé vált az OpenAI GPT-6 Astra modellje. A vállalati munkára szánt rendszer összetett feladatokat bont lépésekre…

A Microsoft bemutatta a MAI-Transcribe-2 beszédfelismerő modellt
A Microsoft 2026. szeptember 3-án bemutatta a MAI-Transcribe-2 beszédfelismerő és átíró modellt. A vállalat szerint ez az eddigi legerősebb transzkripciós modellje…