Kutatás

Az MIT kutatói szerint az MI új szemmel vizsgálhatja a városokat
A vizuális mesterséges intelligencia minden korábbinál nagyobb léptékben segíthet feltérképezni a városi életet, de a tömeges megfigyelés és az algoritmikus elfogultság…

Az Apple tömörítette az eszközön futó beszédfelismerés enkóderét
Az Apple kutatói olyan módszert mutattak be, amellyel tömöríthető a vállalat eszközön futó diktálási rendszerének beszédfelismerő tokenizálója. A 2,8-szor kisebb modell…

Az Apple új módszert mutatott be a beszédfelismerő modellek tanítására
Az Apple kutatói olyan módszert vizsgáltak, amely címkézetlen felhasználói adatokkal is stabilabbá teheti a federált automatikus beszédfelismerés tanítását. A…

Az Apple kutatói szerint a tudáslepárlás tokenenként változó eredményt ad
Az Apple kutatói olyan, tanítás nélkül használható diagnosztikai keretrendszert mutattak be, amely tokenenként, kérdésenként és tanármodellenként vizsgálja az on-policy…

Az AI-ügynökök már szervezeti folyamatokban dolgoznak, de korlátozott önállósággal
Az AI-ügynökök egyre több szervezeti folyamatban jelennek meg, a szoftverfejlesztéstől és kiberbiztonságtól a közigazgatásig. Az OECD szerint a vizsgált szervezetek…

A GPT-5.6 Sol vezeti a régi rendszerekre szabott tesztet
A GPT-5.6 Sol érte el a legjobb eredményt a Factory Legacy-Bench nevű tesztjén, amely a COBOL, a Java 7, a BASIC, a C89, a Fortran és az Assembly kezelését vizsgálja. A…

Az Arize szerint a Jev 300-szor olcsóbban érte el Claude Opus 5 pontosságát
A Jev a Claude Opus 5-tel azonos, 87 százalékos pontosságot ért el az Arize hallucination detection tesztjén, miközben a vállalat szerint körülbelül 300-szor olcsóbb és…

Az NVIDIA nyílt 3D CT-modellt mutatott be radiológiai következtetéshez
Az NVIDIA bemutatta az NV-Reason-CT-t, egy 3D CT-vizsgálatok elemzésére fejlesztett látásnyelvi modellt. A rendszer strukturált leleteket és radiológusi gondolkodást…

A LanceDB összevetette a Lance, a Delta Lake és az Iceberg teljesítményét
A LanceDB S3-on végzett, 10 000 commitot vizsgáló benchmarkja szerint a Lance rövidebb commitkésleltetést és kisebb aktív metaadat-lábnyomot ért el, mint a Delta Lake és…

A Kilo Swarm 39 százalékkal csökkentette a költséget egy célfeladaton
A Kilo Swarm egy összetett, több ügynökkel végzett fejlesztési feladaton 39,2 százalékkal csökkentette a költséget, miközben a teszt mind a tíz futása sikeres lett. A…

Öt új kutató csatlakozott az MIT AI-központú ösztöndíjprogramjához
Öt posztdoktori kutató csatlakozott ősszel az MIT Schwarzman College of Computing Tayebati Postdoctoral Fellowship Programjához. A 2026-os ösztöndíjasok a mesterséges…

A Microsoft AI-eszközzel vizsgálták a szennyvíz vírusait
A Microsoft Discovery AI-ügynökei felgyorsíthatják a szennyvízből származó metagenomikai adatok feltáró elemzését, miközben a tudományos értelmezés a szakértő kezében…

A Microsoft szerint nem kell minden robotba nagy GPU
A robotok fedélzeti GPU-ira épülő megközelítés teljesítményben, üzemidőben és skálázhatóságban is korlát lehet a Microsoft Research új kutatása szerint. A cég azt…

Az NVIDIA tesztje szerint sok kódolóügynök elbukik éles kiszolgálásban
Az NVIDIA új SWE-Serve benchmarkja azt vizsgálja, hogy az AI-kódolóügynökök javításai működnek-e valódi modellkiszolgálás közben. A 19, éles szervert indító feladatnál a…

Miért vezetnek továbbra is a zárt AI-modellek a nyílt modelleknél?
A vállalatok továbbra is elsősorban zárt, szabadalmaztatott AI-modellekre költenek, pedig a nyílt modellek sok esetben hasonló teljesítményt kínálnak jóval alacsonyabb…

A Snorkel szerint az Opus 5.5 vezet a kódolási tesztben
Az Opus 5.5 érte el a legmagasabb összesített sikerarányt a Snorkel AI szakértők által összeállított kódolási feladatsorán. A modell 68 százalékos eredményt ért el…

Az MLCommons az AIRIS projektben méri majd az orvosi AI megbízhatóságát
Az MLCommons csatlakozott az uniós finanszírozású AIRIS kutatási projekthez, amely biológiai ismereteket és klinikai adatokat integráló generatív AI-modelleket fejleszt.…

A vállalatok többsége már autonóm AI-ra készül a hálózatokban
A vállalatok gyorsan térnek át a tanácsadó szerepű mesterséges intelligenciáról az önállóan cselekvő AgenticOps rendszerekre. A Cisco és az Omdia felmérése szerint a…

A Qodo szerint az AI-kód ellenőrzése lett a fejlesztés szűk keresztmetszete
A szervezetek 89 százaléka már tapasztalt mesterséges intelligenciához kapcsolódó éles üzemzavart, miközben a fejlesztési folyamatok ellenőrzése nem tartott lépést az AI…

AI csökkentette az energiafelhasználást egy kínai távhőrendszerben
AI-alapú előrejelzéssel, vezérléssel és hibadetektálással csökkentette energiafelhasználását egy kínai távhőszolgáltató. A changshai rendszerben az áramfogyasztás több…

A beszédfelismerők még elbuknak, ha más is beszél a háttérben
A modern beszédfelismerők jól kezelik a forgalom, a légkondicionáló és a billentyűzet zaját, de egy másik beszélő hangja továbbra is komoly hibákat okoz. A Krisp 265…

David Siegel lesz az MIT következő innovációs ösztöndíjasa
David Siegel számítástechnikus, vállalkozó és filantróp lesz az MIT következő Innovation Fellow ösztöndíjasa. A 2026 és 2027 közötti tanévben azt vizsgálja az MIT…
KutatásAz OpenAI új benchmarkkal méri az AI mentális egészségügyi válaszait
Az OpenAI bemutatta a MentalHealthBench nevű, nyílt benchmarkot, amely azt méri, hogyan reagálnak az AI-rendszerek a mentális egészséggel kapcsolatos beszélgetésekben. A…

A munka már AI-jal kezdődik, de a befejezés továbbra is kézi
A szakemberek 54 százaléka már AI-asszisztenssel kezdi az új tudásmunkát, a kész munka létrehozásához azonban továbbra is sok kézi lépésre van szükség. A Dropbox…