nyelvi modellek

Olcsóbb és specializáltabb modellekkel gyorsul az AI-verseny
Két nap alatt három jelentős AI-labor új modellt mutatott be: a SpaceXAI Grok 4.7-et, az Anthropic Claude Opus 5.5-öt, az OpenAI pedig a GPT-6 Sol és GPT-6 Luna…
FejlesztőknekAz OpenAI javította a GPT-6 promptgyorsítótárát
Az OpenAI fejlesztette a GPT-6 család promptgyorsítótárát, amely alapértelmezés szerint magasabb találati arányt ígér. A fejlesztők most műszerfallal, hibakereső…

Megérkezett a GPT-6 Sol és Luna a Microsoft Foundryba
A Microsoft általánosan elérhetővé tette a GPT-6 Sol és GPT-6 Luna modelleket a Microsoft Foundryban, így a platformon már három GPT-6 modell szolgálhat termelési célú…
ModellekAz OpenAI bemutatta a GPT-6 Sol és Luna modelleket
Az OpenAI bemutatta a GPT-6 Sol és GPT-6 Luna modelleket, amelyek a vállalat szerint a GPT-6 Astra képességeit alacsonyabb költség mellett teszik elérhetővé. Az API-árak…

NVIDIA: alig lassult a titkosított DeepSeek-R1 futtatás B200 GPU-kon
A nagy nyelvi modellek érzékeny adatokon végzett inferenciájához az NVIDIA szerint úgy adható hardveres védelem, hogy közben a teljesítményveszteség mérsékelt marad. A…

A Microsoft Foundryba érkezett a Claude Opus 5.5
Elérhetővé vált a Claude Opus 5.5 a Microsoft Foundryban, így a fejlesztők és vállalatok hosszabb, több lépésből álló kódolási, elemzési és üzleti feladatokhoz is…

Gyorsabban épít alkalmazásokat az Opus 5.5 a Lovable-ben
Az Opus 5.5 már elérhető a Lovable-ben, és a szolgáltató szerint az Opus 5-höz hasonló eredményt harmadával vagy felével kevesebb lépésben éri el. A modell a meglévő…

Claude Opus 5.5 megjelent a Snowflake Cortex AI platformján
Nyilvános előzetesként elérhetővé vált a Claude Opus 5.5 a Snowflake Cortex AI platformján. A modell ugyanazon a napon bekerült a Snowflake CoCo, CoWork, Cortex Agents…
FejlesztőknekA Shopify napi tanulási hurkot épített PyTorchszal és vLLM-mel
A Shopify olyan folyamatos tanulási hurkot épített PyTorch és vLLM használatával, amely a termelési hibákat naponta modellfrissítésekké alakítja. A PyTorch…

A Snowflake az AI-ügynökök megfigyelhetőségét készíti elő
A Snowflake az AI-ügynökök és nagy nyelvi modellekre épülő alkalmazások megfigyelésére készít új funkciót az Observe platformon. Az Agent Observability a működés…

Akár 20 millió dollárt kap nyolc kutató új tudományos irányokra
Nyolc, több tudományterületen is tapasztalatot szerzett kutató kap összesen akár 20 millió dolláros támogatást a Schmidt Sciences 2026 Polymaths programjában. A…

Egy újabb modell tette lehetővé az OpenAI fórumának feltörését
Egy korábban sikertelen támadási kísérletből teljes behatolás lett, miután a Hacktron kutatói az újonnan kiadott Claude Opus 5 modellt vetették be. A Kilo Code…

Alibaba 10 billió paraméteres Qwen-modelleket és új AI-chipeket készít
Az Alibaba bemutatta teljes stackre épülő AI-stratégiájának frissített ütemtervét, amely a chipektől és a felhős infrastruktúrától a modelleken át az AI-ügynökökig…
vllm-metal érkezett az Apple chipes gépek párhuzamos kiszolgálására
A vLLM bejelentette a vllm-metal projektet, amely az Apple Silicon gépekre hozza a vLLM ütemezőjét, lapozott KV-gyorsítótárát és OpenAI-kompatibilis szerverét. A…

A GPT-6 Sol és Luna modellek megérkeztek a Vercel AI Gatewayre
A Vercel AI Gatewayen elérhetővé vált az OpenAI GPT-6 Sol és GPT-6 Luna modellje. A szolgáltató szerint a modellek kódoláshoz, számítógépes használathoz és…

A Vercel AI Gatewayre érkezett az Anthropic Claude Opus 5.5 modellje
Elérhetővé vált az Anthropic Claude Opus 5.5 modellje a Vercel AI Gateway szolgáltatásán, ahol hosszú ideig futó ügynöki feladatokhoz, kódoláshoz és szakmai munkához…

Az OpenRouter Batch API-ja akár féláron dolgozza fel a kéréseket
Az OpenRouter új Batch API-ja nagyobb, azonnali választ nem igénylő feladatokhoz kínál költségcsökkentést. A szolgáltatók egy 24 órás időablakon belül dolgozzák fel a…

Az NVIDIA új modellje az ügynöki feladatok tömeges végrehajtására készült
Az NVIDIA Nemotron 3.5 Lightning nevű modellje a sok, jól körülhatárolható ügynöki feladat végrehajtására készült. A 30 milliárd paraméteres kevert szakértői modell…
KutatásA Jev kiválthatja az LLM-es bírákat? Az MLflow tesztelte
A TypeSafe Jev modellje 30 MLflow-val kapcsolatos kérdés mindegyikén egyezett az emberi értékeléssel, miközben a tesztben ez volt a leggyorsabb és legolcsóbb bíró. A…

A Claude Opus 5.5 több hibát találhat, de több megjegyzést is generál
A Claude Opus 5.5 a CodeRabbit tesztjeiben kissé több ismert hibát talált a vállalat éles modellmixénél, miközben alacsonyabb műveleti pontosságot és több megjegyzést…

Akár 95 százalékkal is csökkenthető az AI tokenköltsége az Alteryx szerint
Az Alteryx és partnere, a NextWave egymástól független tokenfogyasztási benchmarkokat végzett. A vállalat szerint a megfelelő üzleti logika, munkafolyamatok és…

A Hugging Face új tokenizálója akár tízszer gyorsabb lehet
A Hugging Face bemutatta a tokenizers v1 kiadásjelölt változatának teljesítménytesztjeit. A fejlesztők szerint az új verzió a v0.23-hoz képest sok esetben tízszeres…

A Xiaomi MiMo V2.6 modelljei megérkeztek a Vercel AI Gatewayre
A Xiaomi három MiMo V2.6 modellje elérhetővé vált a Vercel AI Gatewayen. A Pro, Flash és Pro UltraSpeed változat szöveges, képi, hang- és videóbemenetet is fogad…

A vLLM 5000 tokent ért el GPU-nként a Qwen3.8-2.4T kiszolgálásában
A vLLM közzétette a Qwen3.8-2.4T modell szétválasztott előfeldolgozás és dekódolás alapú kiszolgálásának eredményeit. A GB300 NVL72 fürtön végzett mérésben nagy…