nyelvi modellek

Az OpenRouter új oldalon hasonlítja össze a modellroutereket
Az OpenRouter új Model Router Benchmarks oldalt indított, amely különböző területeken méri össze a modellrouterek teljesítményét. A rendszer a válaszminőséget, a…

A Vercel bemutatta a Jev modellt, amely gyors döntésekre készült
A Vercel AI SDK for Python új, kísérleti evaluate() API-ja egyszerű hozzáférést ad a Jevhez, egy olyan modellhez, amely feleletválasztós kérdésekre válaszol, és a…

Új történetmotorral fejleszti interaktív világait a Hidden Door
A Hidden Door frissítette az interaktív történeteket működtető, fordulóról fordulóra dolgozó motorját. A vállalat szerint a rendszer élesebben reagál a játékos…

Az Apple új módszerrel vizsgálta a többnyelvű modellek működését
Az Apple kutatói képzés nélküli, ABX-alapú feladatokat mutattak be a többnyelvű nyelvi modellek vizsgálatára. Az XLM-R elemzése szerint a nyelvazonosításhoz kapcsolódó…

A Vercel Python SDK-t adott a Jev kísérleti AI-modellhez
A Vercel elérhetővé tette a Jev nevű kísérleti AI-modell használatát Pythonból, az AI SDK új verzióján keresztül. A Jev szűk döntési feladatokra készült: előre megadott…

Az OpenRouter összehasonlító oldalt indított a modellirányítókról
Az OpenRouter új Model Router Benchmarks oldalon hasonlítja össze a különböző modellirányítók teljesítményét. A tesztek a válaszminőséget, a sebességet és a költséget…

Afrikai nyelveket és titkos kéziratokat vizsgál az Amii mesterséges intelligenciája
Az Alberta Machine Intelligence Institute, vagyis az Amii kutatói mesterséges intelligenciával dolgoznak az afrikai nyelvek digitális megőrzésén és több évszázados…

NVIDIA Blackwell GPU-kon gyorsul az OpenAI GPT-6 Astra Ultrafast
Az NVIDIA 2026. október 1-jén közölte, hogy az OpenAI GPT-6 Astra Ultrafast módja NVIDIA Blackwell GPU-kon fut, és már elérhető az OpenAI API-ban, valamint jogosult…

A Microsoft új, valós idejű átírómodellt és hangmodelleket mutatott be
A Microsoft bemutatta első folyamatos átírásra készült modelljét, a MAI-Transcribe-2-Streaminget, amely a cég szerint az Artificial Analysis rangsorában az első helyen…

Új beszédmodelleket mutatott be a Microsoft AI
A Microsoft AI bemutatta első folyamatos átírómodelljét, a MAI-Transcribe-2-Streaminget, valamint két új hangmodellt. A vállalat szerint ezek gyors és természetes…

Az uniopen az Amazon Nova finomhangolásával javította a moderálást
Az uniopen az Amazon Nova 2 Lite modellt saját kiskereskedelmi moderálási szabályaihoz igazította. A finomhangolás és egy későbbi promptmódosítás után mindkét vizsgált…

Az uniopen üzleti szabályokra hangolta az Amazon Nova moderációját
Az AWS bemutatta, hogyan szabta testre a tajvani uniopen az Amazon Nova 2 Lite modellt saját tartalommoderációs szabályaihoz. A felügyelt finomhangolás és egy további…

Két európai nyílt modell érkezik a Cloudflare Workers AI-ra
A Cloudflare elérhetővé teszi a Workers AI platformon az EuroLLM és az Apertus európai nyílt modelleket. A vállalat emellett olyan képzéseket indít, amelyekkel…

Két európai nyílt modell érkezik a Cloudflare Workers AI-ra
A Cloudflare elérhetővé teszi a Workers AI platformon az EuroLLM és az Apertus európai, nyílt modelleket. A vállalat emellett olyan gyakorlati képzéseket indít…

A Nemotron 3.5 ASR a szaúdi arab dialektusokra hangolható
Az NVIDIA olyan finomhangolási munkafolyamatot mutatott be, amellyel a Nemotron 3.5 ASR a szaúdi najdi és hidzsázi arab dialektusok felismerésére szabható. A vállalat…

Az NVIDIA Nemotron a szaúdi arab nyelvjárásokhoz is finomhangolható
Az NVIDIA olyan finomhangolási munkafolyamatot mutatott be, amellyel a Nemotron 3.5 ASR a szaúdi arab Najdi és Hijazi nyelvjárásokhoz igazítható. A vállalat szerint a…

Az Ai2 megnyitotta az Olmo-core 3 MoE-képzési rendszerét
Az Ai2 kiadta az Olmo-core 3-at, a nagy kevert szakértői modellek, vagyis MoE-k képzésére fejlesztett nyílt infrastruktúrát. A rendszerrel 1,2 billió paraméteres modellt…

Az Ai2 megnyitotta az Olmo-core 3 MoE-tréningrendszerét
Az Ai2 bemutatta az Olmo-core 3-at, egy nyílt tréninginfrastruktúrát, amelyet nagy, szakértőkeverékes, vagyis MoE-modellek fejlesztésére terveztek. A rendszerrel a…

Az Apple új módszere saját hibáiból tanítaná tovább az AI-ügynököket
Saját, rövid tanulságok megfogalmazásával javítaná az AI-ügynökök tanulását az Apple új kutatása. Az RLTL;DR nevű módszer olyan feladatokra céloz, ahol a modell…

Nem érhető el a Goodfire kutatásának érdemi szövege
A megadott Goodfire-forrásrészlet nem tartalmazza a „Forking Fast: Efficiently Estimating Uncertainty Dynamics in Text Generation” című kutatás érdemi szövegét vagy…

A Goodfire kutatási oldala az arXivra irányítja az olvasókat
A Goodfire Research „Why Larger Models Learn More” című oldala jelenlegi szövege szerint az arXivra irányítja az olvasókat. A megadott oldalon a kutatás részletes…

A Goodfire kutatási oldala már az arXiv-tanulmányra irányít
A Goodfire Research Belief Dynamics Reveal the Dual Nature of In-Context Learning and Activation Steering című oldala már az arXiv-tanulmányra irányítja az olvasókat. A…

A Goodfire kutatási oldala egy arXiv-tanulmányhoz irányít
A Goodfire „Priors in Time: Missing Inductive Biases for Language Model Interpretability” című kutatási oldala jelenleg egy arXiv-tanulmányhoz irányítja az olvasókat. Az…

A Goodfire kutatási oldala az arXivra irányít a mechanizmusokról
A Goodfire Research Mixing Mechanisms: How Language Models Retrieve Bound Entities In-Context című oldala egy arXiv-papírhoz irányítja az olvasókat. A megadott…