nyelvi modellek

A GLM-5.3 olcsóbban hoz több megoldást, ha lehet újrapróbálkozni
A GPT-5.6 Sol pontosabb első próbálkozásra a DeepSWE programozási feladatain, a GLM-5.3 viszont olcsóbb, több próbálkozással megelőzi, és a két modell együtt adja a…

A DeepSeek API ára mostantól attól is függ, mikor használják
A DeepSeek API-kulcs létrehozása néhány lépésből áll, maga a kulcs pedig ingyenes. A használat díja azonban 2026. augusztus 16. óta időfüggő: a csúcsidős árak kétszer…
KutatásAz Anthropic feltárta, hogyan torzíthatják a nyelvi modellek súlyai az értelmezést
Az Anthropic kutatói egy egyrétegű transzformerben vizsgálták, hogyan különíthetők el a modell ténylegesen hasznos kapcsolatai az értelmezést zavaró, úgynevezett…

IsoExec: bitpontos végrehajtással csökkentené az RL-rendszerek eltéréseit
A vLLM bemutatta az IsoExecet, a SkyRL-hez készült egységes végrehajtási absztrakciót, amely a megerősítéses tanulás tréning- és következtetési motorjai közötti…

Akár 3,2-szer gyorsabb inferenciát ígér az LFM2.5-DSpark
A Hugging Face-en 2026. augusztus 20-án jelent meg a LiquidAI bejegyzése az LFM2.5-DSpark modellről. A cím szerint a megoldás akár 3,2-szer gyorsabb inferenciát kínál.

Apple módszert dolgozott ki az optimális tanítási adatkeverékhez
Az Apple kutatói olyan módszert mutattak be, amely skálázási törvényekkel becsüli meg a nagy mesterségesintelligencia-modellekhez használható optimális tanítási…

Az Apple olcsóbb módszert mutatott be multimodális modellek tanítására
Az Apple kutatói bemutatták a MixAtlas nevű keretrendszert, amely kisebb proxy modellek segítségével optimalizálja a multimodális nagy nyelvi modellek tanításához…

A Liquid AI DSpark modelljei akár 3,18-szoros gyorsulást ígérnek
A Liquid AI elérhetővé tette három LFM2.5 modell DSpark változatát, amelyek a vállalat mérései szerint akár 3,18-szoros átviteli sebességet kínálnak GPU-n, és akár…

A Harvey bemutatta első utótréningezett, nyílt súlyú modelljét
A Harvey bemutatta a Harvey Tenet kutatási előzetesét, a vállalat első utótréningezett, nyílt súlyú modelljét. A Kimi K3 alapjaira épülő rendszert hosszú, ügynöki…

Az LLM-ek többsége bizonytalan az erkölcsi dilemmákban
A nagy nyelvi modellek az egyértelmű erkölcsi helyzetekben többnyire az emberek által helyesnek tartott választ adják, a kétértelmű dilemmákban azonban gyakran…

A nagyobb nyelvi modellek önmagukban nem lesznek ellenállóbbak
A nagyobb nyelvi modellek önmagukban nem feltétlenül válnak ellenállóbbá a célzott támadásokkal szemben. A FAR.AI előzetes kísérletei szerint az adversariális tanítással…

A Murf szerint a jó AI-szinkron alapja a kontextusos fordítás
A Murf szerint az AI-szinkronizálás minőségét elsősorban a fordítás határozza meg, nem önmagában a hang természetessége. A vállalat saját benchmarkjében a Murf, a HeyGen…

Cohere: a többnyelvű AI önmagában nem lesz kulturálisan érzékeny
A Cohere 2026. augusztus 19-én ismertetett kutatása szerint a globálisan használható AI-hoz nem elég, ha egy modell sok nyelven beszél. A cég több mint 5,6 millió…

Apple-kutatás: kilenc LLM-bíró csak két független szavazatot ér
A több nagy nyelvi modellből álló értékelőpanelek megbízhatóságát kérdőjelezi meg egy Apple-kutatás: a vizsgált kilenc LLM-bíró információtartalma nagyjából két…

A Liquid AI új 4 bites modelljei visszanyerik a pontosság nagy részét
A Liquid AI négy új, 4 bites LFM2.5 checkpointot adott ki, amelyeket kvantálástudatos desztillációval, QAD-del készített. A vállalat szerint a modellek megtartják a Q4_0…

Külön fast modellt kapott a Ling-3.0-flash a Novita AI-nál
A Novita AI külön szerver nélküli modellazonosítóként tette elérhetővé a Ling-3.0-flash-fast változatot. A nyilvános adatok szerint az alapmodellhez képest ugyanazt a…
Biztonság és etikaA nagyobb nyelvi modelleket könnyebb lehet őszintén tartani
A FAR.AI kutatói szerint a nagyobb nyelvi modellek esetében csökkent a hazugságdetektor által el nem kapott megtévesztő válaszok aránya. A SOLiD módszer a gyanús…

A FAR.AI szerint több ponton megkerülhető a GPT-4 védelme
A FAR.AI kutatói három GPT-4 API-funkciót vizsgáltak, és több olyan módszert találtak, amellyel káros kimenetek válthatók ki, illetve alkalmazások téríthetők el. A…

A Replit új Free Mode módja akár 30-szor több alkotást ígér
A Replit bevezette a Free Mode módot, amelyben a mindennapi feladatok nem használják fel a krediteket. A vállalat szerint a Core előfizetők így akár 30-szor többet…

A gondolkodó AI-modelleket érdemes lehet jóval tovább tanítani
A tesztidős következtetés (test-time reasoning) alapjaiban módosíthatja, hogyan érdemes nyelvi modelleket tanítani. A Snorkel AI kutatói szerint a számítási szempontból…
FejlesztőknekKépgenerálással és ügynöki feladatokkal bővült az MLPerf Client
Az MLCommons kiadta az MLPerf Client v2.0-t, amely a személyi számítógépeken futó mesterséges intelligencia teljesítményét méri. Az új verzió a nyelvi modellek mellett…
KutatásVíz alatti hangokból épít alapmodellt a NEC
A NEC olyan általános célú mesterségesintelligencia-alapmodellt fejleszt, amely nagy mennyiségű víz alatti hangadatból tanulhatja meg az óceáni jelenségek felismerését.…
Biztonság és etikaAz OpenAI lassította a modellskálázást az Astra kiberképességei miatt
Az OpenAI 2026. augusztus 18-án közölte, hogy ideiglenesen lassította legújabb modelljeinek skálázását. A döntést az OpenAI-Hugging Face incidens és az a korai…

Arab nyelven is elérhető a Turnitin AI-szövegfelismerője
A Turnitin kiterjesztette AI-írásfelismerő eszközének nyelvi támogatását az arabra. A szolgáltatás a modern standard arab nyelvű dokumentumoknál becsli az AI által…