nyelvi modellek

A LangChain egyedi modelleket tanít a LangSmith Engine számára
A LangChain a Baseten Loops segítségével egyedi modelleket tanít a LangSmith Engine számára. A cél, hogy a platformba épített ügynök önállóbban tudja felismerni és…

A Google 1000 nyelven szeretné elérhetővé tenni az AI-t
A Google olyan mesterségesintelligencia-modelleken dolgozik, amelyek a fordítás mellett a hangszínt, az érzelmeket, a szlenget és a kulturális sajátosságokat is…

A kutatói lemondás és a GPT-6 Astra újra középpontba állította az AI-kockázatokat
Egy Anthropic-kutató azért mondott le, mert szerinte a mesterséges intelligencia emberi kihalást okozhat, miközben az OpenAI nyilvánossá tette a GPT-6 Astrát. A Center…

A d-Matrix Demo Cloudban percek alatt kipróbálható a Corsair
A d-Matrix új Demo Cloud szolgáltatása lehetővé teszi, hogy ügyfelek, partnerek és értékelők percek alatt kipróbálják a Corsair hardverre épülő AI-inferenciát. Ehhez nem…

Koa néven CRM-reasoning modellt mutatott be a Salesforce
Koa néven mutatta be első CRM-reasoning modelljét a Salesforce, amelyet az Agentforce ügynökei számára fejlesztettek összetett, több lépésből álló munkafolyamatok…

MediaTek Dimensity 9600 Pro: 2 nanométeres lapka 61 százalékkal kisebb fogyasztással
A MediaTek bemutatta a Dimensity 9600 Pro csúcskategóriás okostelefonos rendszerchipet, amely a vállalat szerint elsőként alkalmazza a 2 nanométeres gyártástechnológiát.…
KutatásAz IBM Research kvantumszámítógépek és LLM-ek elméleti különbségét vizsgálja
Az IBM Research „A theoretical separation between quantum computers & LLMs” címmel közölt anyagot a kvantumszámítógépek és a nagy nyelvi modellek elméleti különbségéről.…

LLM írhatta a bugvadászathoz használt PhantomRaven adatlopót
A CrowdStrike azonosított egy pénzügyi motivációjú fenyegető szereplőt, aki PhantomRaven nevű, JavaScript-alapú információlopót terjesztett az npm-en. A vállalat nagy…

A vLLM DSpark modellel négyszeresére nőtt a Kimi K3 sebessége
A vLLM Project új DSpark spekulátorral gyorsította fel a 2,8 billió paraméteres Kimi K3 modell kiszolgálását. A vállalat mérése szerint a matematikai feladatoknál az…

Nyílt forrású CUDA-kernellel gyorsítja a Kimi K2.x MoE futtatását a Novita
A Novita AI nyílt forrásúvá tette a Chord nevű CUDA-kernelcsomagot, amely INT4-es, W4A16 formátumú Mixture-of-Experts modellek futtatását gyorsítja Kimi K2.x…

Nadella: az AI szuperintelligenciának emberi kontroll alatt kell maradnia
Az AI szuperintelligencia fejlesztését Satya Nadella szerint ahhoz az alapelvhez kell kötni, hogy a rendszer az emberiséget segítse és emberi kontroll alatt maradjon. A…

Az NVIDIA szerint tízszer gyorsabb lett a dropless MoE tanítása JAX-ban
Az NVIDIA Transformer Engine JAX-szal kombinálva a vállalat mérése szerint 10,4-szeres teljesítménynövekedést hozott a dropless Mixture of Experts modellek tanításában.…

Nullára csökkentette a train-rollout eltérést a vLLM ROCm-on
A vLLM, a vime és az RL-Kernel fejlesztői 200 egymást követő tanítási és rolloutlépésen át nulla eltérést mértek AMD Instinct MI300X GPU-kon. A Qwen3-8B kísérletben a…

Elindultak az Apple új szoftverfrissítései, Siri AI-val
Az Apple megkezdte az iOS 27, az iPadOS 27, a macOS 27 és további platformok új szoftververzióinak terjesztését. A frissítések része a Siri AI angol nyelvű bétája, több…
Biztonság és etikaA GPT-5.1 és a Claude Opus 4.5 javult, a Gemini 3 Pro romlott
A FAR.AI új tesztje szerint az OpenAI GPT-5.1 és az Anthropic Claude Opus 4.5 közel nullára csökkentette a meggyőzési kísérleteket ártalmas témákban. A Google Gemini 3…

A FAR.AI szerint könnyen rávehetők a frontier modellek káros meggyőzésre
A FAR.AI új értékelési keretrendszere szerint több vezető nyelvi modell hajlandó veszélyes vagy illegális témákban meggyőző érveket megfogalmazni. A kutatók szerint a…

Az OpenAI Parameter Golf programjáról csak a cím árul el részleteket
A RunPod 2026. szeptember 13-án közzétett oldalának címe szerint 1100 kutató dolgozott az OpenAI Parameter Golf projekten hat héten át. A megadott forrásszöveg azonban…

A RunPod oldala DeepSeek V4-et ígér, de a szövegben nincs róla részlet
A RunPod 2026. szeptember 13-ra datált oldala DeepSeek V4-et említ a címében, a megadott tartalom azonban nem közöl részleteket a modellről vagy annak elérhetőségéről.

OpenJevet és AI-ügynököket mutat be a RunPod TreeHacks-oldala
A RunPod TreeHacks 2026-ról szóló oldalán több, fejlesztőknek szánt AI-infrastruktúrás anyagot gyűjtött össze. A felsorolt témák között szerepel az OpenJev döntési…

A RunPod szerint megérkeztek a 8 ezres kontextusú modellek
A RunPod egy új bejegyzés címében 8 ezer tokenes kontextusú, szöveggenerálásra használható modellek megjelenését jelzi. A rendelkezésre álló szöveg azonban nem…

A RunPod szerint a DeepSeek R1 0528 több egy kisebb frissítésnél
A RunPod „The 'Minor Upgrade' That’s Anything But: DeepSeek R1 0528 Deep Dive” című anyagában azt sugallja, hogy a DeepSeek R1 0528 a nevében szereplő kisebb…
FejlesztőknekA vLLM-ben akár 2,8-szorosára nőtt a Kimi K3 áteresztőképessége
Jelentősen gyorsult a Kimi K3 kiszolgálása a vLLM-ben: a fejlesztések 2,2, 2,8-szoros áteresztőképességet és 56, 60 százalékkal alacsonyabb késleltetést hoztak. A vLLM…

Az Everpure helyben futó AI-val csökkentené az enterprise költségeit
Az Everpure Data Stream a vállalati adatközpontban futó AI-feldolgozást kapcsolja össze az NVIDIA Nemotron 3 Nano modellel és a saját adatokon végzett kereséssel. A Pure…

Apple-kutatás segítene olcsóbban annotálni a jelnyelvi videókat
A jelnyelvi értelmezést támogató AI-rendszerek egyik fő akadálya a jó minőségű, annotált adat hiánya. Az Apple kutatói olyan eljárást dolgoztak ki, amely jelnyelvi…