kutatási eredmény

Egyetlen látens tokennel tenné hatékonyabbá a képgenerálást az RepTok
Egyetlen folytonos látens tokennel reprezentálja a képeket a RepTok nevű generatív modellezési keretrendszer. A módszer önfelügyelt látásalapú transzformerek…

A Hugging Face bemutatta a Real World VoiceEQ beszéd-AI-mérést
A Hugging Face bemutatta a Real World VoiceEQ benchmarkot, amelynek célja a hangalapú mesterséges intelligencia emberi minőségének mérése. A kezdeményezéshez rendezhető…

Ötezer Kaggle-versenyző mutatta meg, hogyan javítható az AI érvelése
Több mint 5000 résztvevő és 4000 csapat dolgozott az NVIDIA Nemotron Model Reasoning Challenge feladatain, ahol azonos modell és korlátozások mellett kellett javítani az…

A NVIDIA szerint egy nap alatt 93 százalék fölé javítható a Cosmos 3
A NVIDIA TAO agent skills segítségével a Cosmos 3 Nano videós kérdésválaszolási pontossága 54,41 százalékról 93,35 százalékra nőtt a vállalat kísérletében. A NVIDIA…

MIT-hallgatók mesterséges intelligenciával építettek sugárhajtóművet
Az MIT hallgatói mesterséges intelligenciával támogatva terveztek, gyártottak és teszteltek kis sugárhajtóműveket egy négyhetes versenyen. A JARVIS Challenge…

Az Anthropic 10 millió kanadai dollárt ad AI-kutatásra
Az Anthropic 10 millió kanadai dollárt fordít kanadai kutatóintézetek támogatására. A programban egyetemek, kórházak és regionális AI-intézetek vesznek részt, miközben a…

A Tiny Aya kutatói telefonon futó, többnyelvű AI-eszközöket építettek
A Cohere Tiny Aya modelljére építve kutatók és fejlesztők offline oktatási asszisztenst, többnyelvű biztonsági teszteket és helyben futó dokumentumkezelőt készítettek. A…

Az NVIDIA dekódere több mint 347-szer javította a kvantumhibák arányát
Az NVIDIA szerint Ising Decoder ColorCode 1 Fast modellje több mint 347,7-szer jobb logikai hibaarányt és 7,3-szer gyorsabb futást ért el a Chromobius dekóderhez képest.…

A Microsoft formálisan ellenőrzi a Rustban írt kriptográfiai kódot
A Microsoft Research nyilvánosságra hozta a SymCrypt kriptográfiai könyvtár Rustban írt algoritmusainak formális ellenőrzéséhez használt specifikációkat és…

NVIDIA módszere ritka trópusi ciklonok valószínűségét becsüli
Az NVIDIA olyan diffúziós klímamodell-alapú módszert mutatott be, amely ritka trópusi ciklonállapotok felé irányítja a mintavételezést, majd odds ratio segítségével…

Új módszerrel szűrhetik ki a gyermekekre veszélyes AI-modelleket
Az MIT kutatói olyan ellenőrzési eljárást fejlesztettek, amely generált tartalom létrehozása nélkül képes azonosítani a gyermekek szexuális bántalmazását ábrázoló…

A Vapi szerint már szinte emberinek hallatszanak a legjobb hangmodellek
A Vapi Humanness Index eredményei szerint a vezető hangmodellek hallgatói megítélés alapján már csak néhány ponttal maradnak el a valódi emberi hangfelvételtől. Az xAI…

Az NVIDIA RoboLabja részletesebben méri a robotok képességeit
Az NVIDIA RoboLab néven új szimulációs platformot mutatott be az általános célú robotpolitikák értékelésére. A rendszer a sikerességi arány mellett a feladatvégrehajtás…

A JAX host offloadinggal enyhíthető a GPU-memória szűkössége
A JAX host offloading a kiválasztott aktivációkat a GPU nagy sávszélességű memóriája helyett a processzor rögzített host memóriájában tárolja. Az NVIDIA mérései szerint…

Az NVIDIA felgyorsítaná a fehérjeszerkezetek AI-alapú előrejelzését
Az NVIDIA olyan eszközöket mutatott be, amelyek a fehérjeszerkezetek és molekuláris komplexek AI-alapú előrejelzésének több lépését is felgyorsítják. A vállalat szerint…

A Cohere dinamikus spekulatív dekódolással gyorsítaná az LLM-eket
A Cohere olyan dinamikus spekulatív dekódolási módszert mutatott be, amely a hardver terheléséhez igazítja, hány tokent készítsen elő egy kisebb modell. A vállalat…

Az NVIDIA 502 ezer egyedi pénzügyi hírcímet generált
Az NVIDIA 502 536 egyedi pénzügyi hírcímet állított elő szintetikusadat-generáló folyamatával. A NeMo Data Designer, a NeMo Curator és a Nemotron 3 Nano együtt olyan…

A Google SensorFM modellje több mint egybillió percnyi adatból tanul
A Google Research bemutatta a SensorFM-et, egy viselhető egészségügyi adatokra fejlesztett alapmodellt, amely öt millió ember több mint egybillió percnyi szenzoradatán…

Az Apple új benchmarkkal méri a hosszú videók összefoglalását
Az Apple bemutatta az LVSum nevű benchmarkot, amely azt vizsgálja, mennyire pontosan foglalják össze a multimodális nagy nyelvi modellek a hosszú videókat. A rendszer…

Az Apple új tesztje a videós történetek megértését vizsgálja
Az Apple kutatói bemutatták a NarrativeTrack nevű benchmarkot, amely a multimodális nagy nyelvi modellek videós történetmegértését méri. A rendszer azt vizsgálja, hogy a…

Új módszer mutatja meg, valóban érti-e a videót egy AI-modell
Az Apple kutatói olyan értékelési módszert mutattak be, amely különválasztja a videós nyelvi modellek tudásalapú, képi és valódi időbeli következtetési képességeit. A…

Az Apple 829 órányi videóval tanítaná ügyesebb robotkezeket
Az Apple bemutatta az EgoDex nevű, nyílt forrású adatbázist és benchmarkot, amely 829 órányi, emberi kézmozdulatokat rögzítő, nézőponti videót tartalmaz. A kutatók 194…

Az AI saját gondolatmenete nem mindig tükrözi, amit valójában számol
A nagy nyelvi modellek gondolatmenete, vagyis a Chain of Thought, nem mindig mutatja meg hűen, hogyan jutottak el a válaszhoz. Az Amii szerint ezért ez a szöveg nem…

Az NVIDIA szerint GPU-kkal akár 8,2-szer gyorsabb lehet a Presto
Az NVIDIA GPU-gyorsított Presto megoldása a vállalat méréseiben akár 8,2-szer rövidebb lekérdezési időt ért el egy nyolc csomópontos Intel Xeon klaszterhez képest. A…