kutatási eredmény

A navigációs appok összehangolása csökkentheti a városi dugókat
A navigációs alkalmazásokban módosított útvonalajánlásokkal mérhetően javult a forgalom 10 nagy amerikai városban. A Google Research szerint az érintett utak sebessége…

Az AI21 Labs olcsóbban futtatná a kódoló ügynököket
Az AI21 Labs olyan futtatási stratégiákat vizsgált szoftverfejlesztő ügynökökhöz, amelyek a feladat nehézségéhez igazítják a felhasznált számítási keretet. A vállalat…

Berkeley kutatói szerint az olcsó AI új adatkezelési rendszereket kíván
A mesterséges intelligencia használatának költsége gyorsan csökken, ezért a Berkeley kutatói szerint az adatkezelési rendszereket az ügynökök tömeges használatához kell…

A Goodfire új módszerrel tárná fel a lát मॉडलlek belső fogalmait
A Goodfire bemutatta a Block-Sparse Featurizers, röviden BSF nevű módszercsaládot, amely a neurális hálózatok aktivációit többdimenziós alterekre bontja. A vállalat…

Nyílt forrású arab beszédfelismerő modellt adott ki a Cohere
A Cohere nyílt forrásúvá tette a Cohere Transcribe Arabic beszédfelismerő modellt, amelyet arab dialektusokra, kétnyelvű beszédre és vállalati használatra…

Az Antidoom módszerrel csökkentené a modellek végtelen ismétléseit a Liquid AI
A Liquid AI olyan célzott tanítási módszert mutatott be, amely a gondolkodó modellek ismétlődő szöveghurokjait, az úgynevezett doom loopokat mérsékli. Az Antidoom…

Az NVIDIA új módszerrel tartaná egyenletesen az LLM-ek tanítási teljesítményét
Az NVIDIA olyan kísérleti módszert mutatott be, amely átmeneti GPU-kiesések esetén dinamikusan módosítja a tenzorpárhuzamosítás mértékét. A Nonuniform Tensor Parallelism…

Az ICML kutatásai szerint az open modellekre épül az AI-fejlesztés
Az ICML 2026 elfogadott tanulmányai alapján az open modellek és a nyílt AI-infrastruktúra egyre fontosabb alapot jelentenek a mesterségesintelligencia-kutatásban. Az…

A Hugging Face közzétette a Photoroom PRX adatstratégiájáról szóló részt
A Hugging Face oldalán megjelent a Photoroom PRX sorozatának negyedik része, amelynek címe Our Data Strategy. A bejegyzés a sorozat korábbi, modelltréninggel foglalkozó…

Az Apple LaCy módszere megtanítja a kis nyelvi modelleket segítséget kérni
Az Apple kutatói bemutatták a LaCy nevű előtanítási módszert, amely segít a kis nyelvi modelleknek eldönteni, mely tokeneket tanulják meg, és mikor kérjenek segítséget…

Az annotációk mérsékelhetik a nyelvi modellek sokféleségének összeomlását
Az annotációkra épülő tanítás mérsékelheti azt a sokféleségvesztést, amely a nyelvi modellek felügyelt finomhangolása után jelentkezik. Az Apple kutatói szerint…

Az Apple térképekkel segítené az LLM-ek viselkedési szabályainak tervezését
Az Apple kutatói Policy Maps néven olyan módszert mutattak be, amely térképszerű ábrázolással segíti a nagy nyelvi modellek viselkedésére vonatkozó szabályok…

RayRoPE: új pozíciókódolást mutatott be az Apple a többnézetű modellekhez
Az Apple bemutatta a RayRoPE nevű pozíciókódolási módszert, amelyet többnézetű transzformerekhez terveztek. A kutatók szerint az eljárás javította az új nézetek…

Az Apple megosztott útválasztót javasol a beszédfelismerő MoE-modellekhez
Az Apple kutatói olyan Omni-router Transformer modellt mutattak be, amely a beszédfelismerésben több rétegen keresztül megosztja az útválasztási döntéseket. A kutatás…

Az Apple kutatói képpel és szöveggel is vezérelhető szegmentáló modellt mutattak be
Az Apple kutatói a COSINE nevű, nyílt világú képszegmentáló modellt mutatták be, amely képeket és szöveget is használhat bemenetként. A rendszer az eltérő szegmentálási…

Az Amii hat kutatási eredményt mutat be az ICML 2026-on
Az Amii kutatói és hallgatói több, a mesterséges intelligencia alapkutatásához kapcsolódó eredményt mutatnak be az ICML 2026 konferencián Szöulban. A bemutatott munkák a…

Három rétegben méri az Owkin a tudományos AI-ügynök megbízhatóságát
Az Owkin háromszintű értékelési rendszert dolgozott ki K Pro nevű, biomedicinális kutatást segítő AI-ügynökéhez. A módszer az egyes eszközhívásokat, a teljes…