Mesterséges intelligencia, magyarul.
Az eredeti közleményekből.

nyelvi modellek

A GLM-5.3 olcsóbban hoz több megoldást, ha lehet újrapróbálkozni
Kutatás2026. augusztus 21.

A GLM-5.3 olcsóbban hoz több megoldást, ha lehet újrapróbálkozni

A GPT-5.6 Sol pontosabb első próbálkozásra a DeepSWE programozási feladatain, a GLM-5.3 viszont olcsóbb, több próbálkozással megelőzi, és a két modell együtt adja a…

A DeepSeek API ára mostantól attól is függ, mikor használják
Termékek és eszközök2026. augusztus 21.

A DeepSeek API ára mostantól attól is függ, mikor használják

A DeepSeek API-kulcs létrehozása néhány lépésből áll, maga a kulcs pedig ingyenes. A használat díja azonban 2026. augusztus 16. óta időfüggő: a csúcsidős árak kétszer…

Kutatás
Kutatás2026. augusztus 21.

Az Anthropic feltárta, hogyan torzíthatják a nyelvi modellek súlyai az értelmezést

Az Anthropic kutatói egy egyrétegű transzformerben vizsgálták, hogyan különíthetők el a modell ténylegesen hasznos kapcsolatai az értelmezést zavaró, úgynevezett…

IsoExec: bitpontos végrehajtással csökkentené az RL-rendszerek eltéréseit
Fejlesztőknek2026. augusztus 21.

IsoExec: bitpontos végrehajtással csökkentené az RL-rendszerek eltéréseit

A vLLM bemutatta az IsoExecet, a SkyRL-hez készült egységes végrehajtási absztrakciót, amely a megerősítéses tanulás tréning- és következtetési motorjai közötti…

Akár 3,2-szer gyorsabb inferenciát ígér az LFM2.5-DSpark
Modellek2026. augusztus 20. 18:52

Akár 3,2-szer gyorsabb inferenciát ígér az LFM2.5-DSpark

A Hugging Face-en 2026. augusztus 20-án jelent meg a LiquidAI bejegyzése az LFM2.5-DSpark modellről. A cím szerint a megoldás akár 3,2-szer gyorsabb inferenciát kínál.

Apple módszert dolgozott ki az optimális tanítási adatkeverékhez
Kutatás2026. augusztus 20.

Apple módszert dolgozott ki az optimális tanítási adatkeverékhez

Az Apple kutatói olyan módszert mutattak be, amely skálázási törvényekkel becsüli meg a nagy mesterségesintelligencia-modellekhez használható optimális tanítási…

Az Apple olcsóbb módszert mutatott be multimodális modellek tanítására
Kutatás2026. augusztus 20.

Az Apple olcsóbb módszert mutatott be multimodális modellek tanítására

Az Apple kutatói bemutatták a MixAtlas nevű keretrendszert, amely kisebb proxy modellek segítségével optimalizálja a multimodális nagy nyelvi modellek tanításához…

A Liquid AI DSpark modelljei akár 3,18-szoros gyorsulást ígérnek
Modellek2026. augusztus 20.

A Liquid AI DSpark modelljei akár 3,18-szoros gyorsulást ígérnek

A Liquid AI elérhetővé tette három LFM2.5 modell DSpark változatát, amelyek a vállalat mérései szerint akár 3,18-szoros átviteli sebességet kínálnak GPU-n, és akár…

A Harvey bemutatta első utótréningezett, nyílt súlyú modelljét
Modellek2026. augusztus 20.

A Harvey bemutatta első utótréningezett, nyílt súlyú modelljét

A Harvey bemutatta a Harvey Tenet kutatási előzetesét, a vállalat első utótréningezett, nyílt súlyú modelljét. A Kimi K3 alapjaira épülő rendszert hosszú, ügynöki…

Az LLM-ek többsége bizonytalan az erkölcsi dilemmákban
Kutatás2026. augusztus 20.

Az LLM-ek többsége bizonytalan az erkölcsi dilemmákban

A nagy nyelvi modellek az egyértelmű erkölcsi helyzetekben többnyire az emberek által helyesnek tartott választ adják, a kétértelmű dilemmákban azonban gyakran…

A nagyobb nyelvi modellek önmagukban nem lesznek ellenállóbbak
Biztonság és etika2026. augusztus 20.

A nagyobb nyelvi modellek önmagukban nem lesznek ellenállóbbak

A nagyobb nyelvi modellek önmagukban nem feltétlenül válnak ellenállóbbá a célzott támadásokkal szemben. A FAR.AI előzetes kísérletei szerint az adversariális tanítással…

A Murf szerint a jó AI-szinkron alapja a kontextusos fordítás
Kutatás2026. augusztus 20.

A Murf szerint a jó AI-szinkron alapja a kontextusos fordítás

A Murf szerint az AI-szinkronizálás minőségét elsősorban a fordítás határozza meg, nem önmagában a hang természetessége. A vállalat saját benchmarkjében a Murf, a HeyGen…

Cohere: a többnyelvű AI önmagában nem lesz kulturálisan érzékeny
Kutatás2026. augusztus 19.

Cohere: a többnyelvű AI önmagában nem lesz kulturálisan érzékeny

A Cohere 2026. augusztus 19-én ismertetett kutatása szerint a globálisan használható AI-hoz nem elég, ha egy modell sok nyelven beszél. A cég több mint 5,6 millió…

Apple-kutatás: kilenc LLM-bíró csak két független szavazatot ér
Kutatás2026. augusztus 19.

Apple-kutatás: kilenc LLM-bíró csak két független szavazatot ér

A több nagy nyelvi modellből álló értékelőpanelek megbízhatóságát kérdőjelezi meg egy Apple-kutatás: a vizsgált kilenc LLM-bíró információtartalma nagyjából két…

A Liquid AI új 4 bites modelljei visszanyerik a pontosság nagy részét
Modellek2026. augusztus 19.

A Liquid AI új 4 bites modelljei visszanyerik a pontosság nagy részét

A Liquid AI négy új, 4 bites LFM2.5 checkpointot adott ki, amelyeket kvantálástudatos desztillációval, QAD-del készített. A vállalat szerint a modellek megtartják a Q4_0…

Külön fast modellt kapott a Ling-3.0-flash a Novita AI-nál
Modellek2026. augusztus 19.

Külön fast modellt kapott a Ling-3.0-flash a Novita AI-nál

A Novita AI külön szerver nélküli modellazonosítóként tette elérhetővé a Ling-3.0-flash-fast változatot. A nyilvános adatok szerint az alapmodellhez képest ugyanazt a…

Biztonság és etika
Biztonság és etika2026. augusztus 19.

A nagyobb nyelvi modelleket könnyebb lehet őszintén tartani

A FAR.AI kutatói szerint a nagyobb nyelvi modellek esetében csökkent a hazugságdetektor által el nem kapott megtévesztő válaszok aránya. A SOLiD módszer a gyanús…

A FAR.AI szerint több ponton megkerülhető a GPT-4 védelme
Cégek és üzlet2026. augusztus 19.

A FAR.AI szerint több ponton megkerülhető a GPT-4 védelme

A FAR.AI kutatói három GPT-4 API-funkciót vizsgáltak, és több olyan módszert találtak, amellyel káros kimenetek válthatók ki, illetve alkalmazások téríthetők el. A…

A Replit új Free Mode módja akár 30-szor több alkotást ígér
Termékek és eszközök2026. augusztus 18. 19:59

A Replit új Free Mode módja akár 30-szor több alkotást ígér

A Replit bevezette a Free Mode módot, amelyben a mindennapi feladatok nem használják fel a krediteket. A vállalat szerint a Core előfizetők így akár 30-szor többet…

A gondolkodó AI-modelleket érdemes lehet jóval tovább tanítani
Kutatás2026. augusztus 18. 17:06

A gondolkodó AI-modelleket érdemes lehet jóval tovább tanítani

A tesztidős következtetés (test-time reasoning) alapjaiban módosíthatja, hogyan érdemes nyelvi modelleket tanítani. A Snorkel AI kutatói szerint a számítási szempontból…

Fejlesztőknek
Fejlesztőknek2026. augusztus 18. 16:50

Képgenerálással és ügynöki feladatokkal bővült az MLPerf Client

Az MLCommons kiadta az MLPerf Client v2.0-t, amely a személyi számítógépeken futó mesterséges intelligencia teljesítményét méri. Az új verzió a nyelvi modellek mellett…

Kutatás
Kutatás2026. augusztus 18. 04:00

Víz alatti hangokból épít alapmodellt a NEC

A NEC olyan általános célú mesterségesintelligencia-alapmodellt fejleszt, amely nagy mennyiségű víz alatti hangadatból tanulhatja meg az óceáni jelenségek felismerését.…

Biztonság és etika
Biztonság és etika2026. augusztus 18. 13:00

Az OpenAI lassította a modellskálázást az Astra kiberképességei miatt

Az OpenAI 2026. augusztus 18-án közölte, hogy ideiglenesen lassította legújabb modelljeinek skálázását. A döntést az OpenAI-Hugging Face incidens és az a korai…

Arab nyelven is elérhető a Turnitin AI-szövegfelismerője
Termékek és eszközök2026. augusztus 18. 07:00

Arab nyelven is elérhető a Turnitin AI-szövegfelismerője

A Turnitin kiterjesztette AI-írásfelismerő eszközének nyelvi támogatását az arabra. A szolgáltatás a modern standard arab nyelvű dokumentumoknál becsli az AI által…

1…13141516171819…22