Kutatás

A drágább Fable 5-tel mégis olcsóbb lett a Devin használata
A Fable 5 tokenenként kétszer annyiba kerül, mint az Opus 4.8, a Cognition tesztje szerint mégis olcsóbban futott vele a Devin. A különbséget az ügynökök munkaszervezése…

A Vapi szerint már szinte emberinek hallatszanak a legjobb hangmodellek
A Vapi Humanness Index eredményei szerint a vezető hangmodellek hallgatói megítélés alapján már csak néhány ponttal maradnak el a valódi emberi hangfelvételtől. Az xAI…

Az NVIDIA RoboLabja részletesebben méri a robotok képességeit
Az NVIDIA RoboLab néven új szimulációs platformot mutatott be az általános célú robotpolitikák értékelésére. A rendszer a sikerességi arány mellett a feladatvégrehajtás…

Az NVIDIA felgyorsítaná a fehérjeszerkezetek AI-alapú előrejelzését
Az NVIDIA olyan eszközöket mutatott be, amelyek a fehérjeszerkezetek és molekuláris komplexek AI-alapú előrejelzésének több lépését is felgyorsítják. A vállalat szerint…

A Cohere dinamikus spekulatív dekódolással gyorsítaná az LLM-eket
A Cohere olyan dinamikus spekulatív dekódolási módszert mutatott be, amely a hardver terheléséhez igazítja, hány tokent készítsen elő egy kisebb modell. A vállalat…

A Microsoft új Aurora modellje óránkénti és valószínűségi időjárás-előrejelzést ad
A Microsoft bemutatta az Aurora 1.5-öt, a Földrendszer modellezésére fejlesztett nyílt alapmodell jelentős frissítését. Az új verzió 22 időjárási változóval, óránkénti…

A Google SensorFM modellje több mint egybillió percnyi adatból tanul
A Google Research bemutatta a SensorFM-et, egy viselhető egészségügyi adatokra fejlesztett alapmodellt, amely öt millió ember több mint egybillió percnyi szenzoradatán…

Az Apple új benchmarkkal méri a hosszú videók összefoglalását
Az Apple bemutatta az LVSum nevű benchmarkot, amely azt vizsgálja, mennyire pontosan foglalják össze a multimodális nagy nyelvi modellek a hosszú videókat. A rendszer…

Az Apple új tesztje a videós történetek megértését vizsgálja
Az Apple kutatói bemutatták a NarrativeTrack nevű benchmarkot, amely a multimodális nagy nyelvi modellek videós történetmegértését méri. A rendszer azt vizsgálja, hogy a…

Új módszer mutatja meg, valóban érti-e a videót egy AI-modell
Az Apple kutatói olyan értékelési módszert mutattak be, amely különválasztja a videós nyelvi modellek tudásalapú, képi és valódi időbeli következtetési képességeit. A…

Az Apple 829 órányi videóval tanítaná ügyesebb robotkezeket
Az Apple bemutatta az EgoDex nevű, nyílt forrású adatbázist és benchmarkot, amely 829 órányi, emberi kézmozdulatokat rögzítő, nézőponti videót tartalmaz. A kutatók 194…
KutatásAz OpenAI szerint a SWE-Bench Pro feladatainak 30 százaléka hibás
Az OpenAI visszavonta korábbi ajánlását a SWE-Bench Pro használatára, miután egy audit szerint a benchmark feladatainak mintegy 30 százaléka hibás. A vállalat szerint ez…

Az AI Economy Institute új kutatói az AI munkahelyi hatásait vizsgálják
Az AI Economy Institute elindította harmadik kutatói csoportját, amely azt vizsgálja, hogyan alakítják át a fejlett mesterségesintelligencia-rendszereket alkalmazó…

A navigációs appok összehangolása csökkentheti a városi dugókat
A navigációs alkalmazásokban módosított útvonalajánlásokkal mérhetően javult a forgalom 10 nagy amerikai városban. A Google Research szerint az érintett utak sebessége…

Az AI21 Labs olcsóbban futtatná a kódoló ügynököket
Az AI21 Labs olyan futtatási stratégiákat vizsgált szoftverfejlesztő ügynökökhöz, amelyek a feladat nehézségéhez igazítják a felhasznált számítási keretet. A vállalat…

Berkeley kutatói szerint az olcsó AI új adatkezelési rendszereket kíván
A mesterséges intelligencia használatának költsége gyorsan csökken, ezért a Berkeley kutatói szerint az adatkezelési rendszereket az ügynökök tömeges használatához kell…

A Goodfire új módszerrel tárná fel a lát मॉडलlek belső fogalmait
A Goodfire bemutatta a Block-Sparse Featurizers, röviden BSF nevű módszercsaládot, amely a neurális hálózatok aktivációit többdimenziós alterekre bontja. A vállalat…

Az Antidoom módszerrel csökkentené a modellek végtelen ismétléseit a Liquid AI
A Liquid AI olyan célzott tanítási módszert mutatott be, amely a gondolkodó modellek ismétlődő szöveghurokjait, az úgynevezett doom loopokat mérsékli. Az Antidoom…

Az NVIDIA új módszerrel tartaná egyenletesen az LLM-ek tanítási teljesítményét
Az NVIDIA olyan kísérleti módszert mutatott be, amely átmeneti GPU-kiesések esetén dinamikusan módosítja a tenzorpárhuzamosítás mértékét. A Nonuniform Tensor Parallelism…

Az ICML kutatásai szerint az open modellekre épül az AI-fejlesztés
Az ICML 2026 elfogadott tanulmányai alapján az open modellek és a nyílt AI-infrastruktúra egyre fontosabb alapot jelentenek a mesterségesintelligencia-kutatásban. Az…

A Hugging Face közzétette a Photoroom PRX adatstratégiájáról szóló részt
A Hugging Face oldalán megjelent a Photoroom PRX sorozatának negyedik része, amelynek címe Our Data Strategy. A bejegyzés a sorozat korábbi, modelltréninggel foglalkozó…

Az Apple LaCy módszere megtanítja a kis nyelvi modelleket segítséget kérni
Az Apple kutatói bemutatták a LaCy nevű előtanítási módszert, amely segít a kis nyelvi modelleknek eldönteni, mely tokeneket tanulják meg, és mikor kérjenek segítséget…

Az annotációk mérsékelhetik a nyelvi modellek sokféleségének összeomlását
Az annotációkra épülő tanítás mérsékelheti azt a sokféleségvesztést, amely a nyelvi modellek felügyelt finomhangolása után jelentkezik. Az Apple kutatói szerint…

RayRoPE: új pozíciókódolást mutatott be az Apple a többnézetű modellekhez
Az Apple bemutatta a RayRoPE nevű pozíciókódolási módszert, amelyet többnézetű transzformerekhez terveztek. A kutatók szerint az eljárás javította az új nézetek…