nyelvi modellek

A Vercel AI Gatewayre került az Anthropic Claude Sonnet 5.5 modellje
Elérhetővé vált az Anthropic Claude Sonnet 5.5 modellje a Vercel AI Gateway szolgáltatásában. A Vercel szerint az új modell a mindennapi fejlesztési, dokumentumkészítési…

Japán vállalatai és startupjai NVIDIA Nemotron modelleket építenek
Az NVIDIA szerint japán vállalatok és startupok iparágra szabott mesterségesintelligencia-rendszereket építenek a vállalat Nemotron nyílt modelljeivel. A bejelentés…

Az NVIDIA Rubin CPX GPU-járól nem közöl részleteket a megadott forrás
A megadott NVIDIA-forrás címe szerint a vállalat bemutatta a Rubin CPX nevű GPU-t, amelyet nagy kontextusú következtetésre terveztek. A rendelkezésre bocsátott szöveg…

Az NVIDIA bejelentette a Nemotron 3 nyílt modellek családját
Az NVIDIA bejelentette a Nemotron 3 nyílt modellek családját. A megadott forrásrészlet a cím és a kapcsolódó bejegyzések mellett nem közöl részleteket a modellekről.

A Claude Sonnet 5.5 megérkezett a Vercel AI Gateway rendszerébe
Az Anthropic Claude Sonnet 5.5 modellje elérhetővé vált a Vercel AI Gateway szolgáltatásában. A Vercel szerint az új modell a mindennapi fejlesztési és irodai…

Távozik az Aleph Alpha társ-vezérigazgatója, Ilhan Scheer vezeti tovább a céget
Reto Spörri tizennégy hónap után távozik az Aleph Alpha társ-vezérigazgatói posztjáról, hogy új szakmai lehetőségeket keressen. A vállalatot ezt követően Ilhan Scheer…

A Fireworks AI új routere 57 százalékkal csökkentette a költséget
A Fireworks AI bemutatta a FireRouter with Opus szolgáltatást, amely a feladatokat több modell között osztja el. A vállalat belső tesztjeiben a megoldás 57 százalékkal…

Elérhető a Fireworks Ember-1 modellje a Vercel AI Gateway-en
A Fireworks Ember-1 modellje megérkezett a Vercel AI Gateway-re. A Kimi K3-ra épülő, kutatási előzetesként kiadott modell kódolási és ügynökalapú munkafolyamatokat…
Termékek és eszközökA Microsoft új Copilotja a munkát is átadhatja az AI-nak
A Microsoft új Copilotja három irányból közelíti meg az AI használatát: a Home egy felületre hozza a Chatet és a Coworkot, a Code természetes nyelvű alkalmazáskészítést…

A RunPodon már elérhetők a 16 ezres kontextusú LLM-modellek
A RunPod szerint elérhetővé váltak platformján a 16 ezres kontextusablakkal rendelkező nagy nyelvi modellek. A bejelentés részletezi a modellek elérhetőségét, de a…

A Runpod oldala LLM-bootcamp helyett három AI-anyagot listáz
A Runpod megadott oldalának szövege nem a Data Science Dojóval közös LLM-bootcamp részleteit ismerteti. A tartalom három, fejlesztőknek és AI-csapatoknak szóló anyagot…

A Google Cloud útmutatót adott ki a Gemini megerősítéses tanításához
A Google Cloud új útmutatóban mutatja be, hogyan szabhatók testre a Gemini modellek menedzselt megerősítéses tanulási szolgáltatással. A módszer akkor lehet hasznos, ha…

Öt AI-tárolási megoldást mutatott be az Alibaba Cloud az Apsara 2026-on
Külön tárolási megoldásokat kapnak az eltérő AI-terhelések az Alibaba Cloud új portfóliójában. Az Apsara Conference 2026-on bejelentett termékek a nagy nyelvi modellek…

Rustban írták újra a cross-encoder inferenciát, de nem mindenhol lett gyorsabb
A Qdrant Rustban írta újra a cross-encoder modellek futtatását, majd Python-alapú könyvtárakkal hasonlította össze. A cross-encode-rs kis modellen csak mérsékelten…
Ingyenesen kipróbálható a Vercel AI Gateway új Pixel Canary modellje
A Vercel AI Gateway-ben stealth módban, korlátozott ideig ingyenesen érhető el a Pixel Canary modell. A Vercel szerint a modell különösen erős kódolásban…
KutatásAz MLflow tesztjén a Jev gyors volt, de hibákat is átengedett
A Jev strukturált döntési modell az MLflow új tesztjén 72 válaszból 64 esetben egyezett az emberi címkézéssel. A modell gyorsabb és olcsóbb volt a GPT-OSS-120B-nél, de…

Bővíti az AI-ügynökök eszköztárát a Microsoft Azure
Új modellekkel, hangalapú ügynökökkel és hosszú ideig futó feladatok támogatásával bővíti a Microsoft Foundry képességeit a Microsoft. A vállalat szerint a fejlesztők…

Szöveges beszélgetésekből becsülheti az öngyilkossági kockázatot egy MIT-eszköz
Az MIT McGovern Institute kutatói olyan nyelvfeldolgozó eszközt fejlesztettek, amely válságsegítőkkel folytatott szöveges beszélgetések alapján becsüli az öngyilkossági…

A LangChain eszközzel ügynökök munkafolyamataiból lehet finomhangolt modellt készíteni
A LangChain Labs bemutatta a LangSmith Fine-Tuningot és a hozzá tartozó smithtune parancssori eszközt. A megoldás a LangSmithben tárolt ügynök-nyomokból készít…

A Salesforce szerint az AI-ügynökök átalakítják a vállalati szoftvereket
A vállalati szoftverek használata a Salesforce szerint az AI-ügynökök felé mozdul: a felhasználóknak nem feltétlenül kell megnyitniuk a hagyományos alkalmazásfelületet.…

Az NVIDIA szerint akár 2,21-szer gyorsabb lehet az MoE-modellek tanítása
Az NVIDIA olyan módszert mutatott be biológiai alapmodellek szakértői keveréke, vagyis MoE-architektúrákra épülő változatainak tanításához, amely a vállalat…

Az MLPerf új benchmarkkal méri a nagy nyelvi modellek utótréningjét
Az MLPerf Training első alkalommal külön benchmarkkal méri a nagy nyelvi modellek utótréningjét. A teszt a Qwen 3.5 397B modellt szoftverfejlesztési feladatokon…

Gyorsabb lehet a képfeldolgozó LFM2.5-VL modell
A Hugging Face bemutatta az LFM2.5-VL-DSpark megoldást, amely a képet és szöveget is kezelő modellek következtetését gyorsíthatja. A közzétett adatok szerint a gyorsulás…

Több mint 2800 vírus fehérjekomplexumát tették szabadon elérhetővé
Több mint 2800, embereket megfertőzni képes vírus fehérjekomplexumainak előre jelzett háromdimenziós szerkezete került nyíltan elérhetővé az AlphaFold Database-ben. Az…