kutatási eredmény

Stanfordi kutató szerint az AI miatt újra kell gondolni a tanulást
A mesterséges intelligencia miatt az egyetemeknek újra kell gondolniuk, mit tanítsanak, és hogyan mérjék a tudást. Dan Schwartz, a Stanford tanulástudományi szakértője…

A munka már AI-jal kezdődik, de a befejezés továbbra is kézi
A szakemberek 54 százaléka már AI-asszisztenssel kezdi az új tudásmunkát, a kész munka létrehozásához azonban továbbra is sok kézi lépésre van szükség. A Dropbox…

A filler tokenekkel sokkal jobban teljesít a GPT-6-Astra
A GPT-6-Astra jelentősen jobban teljesít több feladaton, ha a kérdéshez értelmetlen filler tokeneket, például pontokat illesztenek, miközben a modellnek azonnal kell…

Claude új, CRISPR-re emlékeztető enzimrendszert talált DNS-adatokban
Egy új, ART-nek nevezett enzimrendszert azonosított Claude nagy DNS-adatbázisok átvizsgálása közben az Anthropic szerint. A rendszer funkcióját még nem ismerik, de több…

Az Apple módszere 128-szor gyorsabb szöveggenerálást ígér
Az Apple kutatói bemutatták az FS-DFM nevű módszert, amely kevés lépéssel gyorsítja fel a diffúziós nyelvi modellek szöveggenerálását. A vállalat szerint a rendszer…

Az új Fireworks-tömörítő közel felére csökkenti az RL-frissítések méretét
A Fireworks bemutatta az ARCv3 tömörítőt, amely a vállalat mérései szerint közel 50 százalékkal csökkenti a megerősítéses tanulás során továbbított BF16-súlyfrissítések…

A Datadog egy 9 milliárd paraméteres modellt tanított riasztások vizsgálatára
A Datadog egy kisebb, célfeladatra finomhangolt Qwen3.5-9B modellel vizsgálja, hogy egy friss változtatás okozhatta-e a production riasztást. A cég szerint a modell a…
Biztonság és etikaA FAR.AI szerint az AI meggyőzéssel is gyengítheti az emberi kontrollt
A FAR.AI egy új keretrendszerben vizsgálja, hogyan használhatja egy mesterséges intelligencia a kommunikációt úgy, hogy azzal gyengítse az emberek kontrollját az…

A videómodellek még látványosan elbuknak a fizika alapjain
A modern videómodellek meggyőző képkockákat készítenek, de ez nem jelenti azt, hogy következetesen értik a háromdimenziós világot. A HumanSignal kísérletei szerint a…

Egymillió dolláros támogatást kapott egy IBD-diagnosztikai AI-projekt
1 040 400 kanadai dolláros támogatást kapott a University of Alberta kutatócsoportja egy olyan mesterségesintelligencia-eszköz fejlesztésére, amely segíthet a…

Gyors döntési modellt tesztelt a Vapi a hangalapú AI biztonságára
A Vapi a TypeSafe AI korai hozzáférésű Jev modelljét tesztelte arra, hogy a hangalapú AI-asszisztensek válaszai megszegnek-e egy előre megadott szabályt. A modell gyors…

A UiPath a vállalati munka térképére építi új ügynökeit
A UiPath a FUSION 2026 rendezvényen olyan új eszközöket mutatott be, amelyek a vállalati tudástérképre, az összetett folyamatok vezérlésére és a tesztelés…

Világszerte terjed az AI, de egyre nagyobb a regionális szakadék
2026 második negyedévében tovább nőtt a generatív mesterséges intelligencia használata világszerte, miközben szélesedett a különbség a globális északi és déli országok…

A Spotify szerint az LLM-ek megbízhatóbban rangsorolhatják az ajánlókat
A Spotify kutatása szerint a nagy nyelvi modellek az egyes ajánlások megítélésében csak közepes pontosságúak, az ajánlórendszerek összehasonlításában viszont megbízható…

A Spotify mesterséges intelligenciával tervez személyre szabott polcokat
A Spotify kutatói olyan ajánlási rendszert mutattak be, amely rögzített sablonok kiválasztása helyett a hallgatói profilok alapján maga generálja az úgynevezett polcok…

Az AI-ügynökök miatt újra kell gondolni az ajánlórendszereket
Az ajánlórendszerek eddig elsősorban közvetlenül az embereknek mutattak tartalmakat és termékeket. Az AI-ügynökök megjelenésével egyre gyakrabban egy olyan szoftver…

Miért nő az adatközpontokkal szembeni ellenállás Pennsylvaniában?
Az amerikaiak több mint 60 százaléka korlátozná az új adatközpontok építését, különösen a saját közösségében. A Data & Society új jelentése szerint Pennsylvaniában…

A Darktrace tesztjében a mesterséges intelligencia hackeléssel próbált csalni
A Darktrace kutatói által végzett ellenőrzött tesztben több AI-ügynök is hackelési módszerekhez fordult, amikor egy kódolási feladatot nem tudott szabályosan…

529 ellenőrzött AI-ügynök-incidenst gyűjt az új AIR-regiszter
Az Anaconda által bemutatott Agent Incident Registry, röviden AIR, 529 ellenőrzött AI-ügynök-incidenst tart nyilván. Ezek közül 200 esetben tényleges kár érte valamelyik…

Az AI-kutatás automatizálása felgyorsíthatja a biztonsági kockázatokat
Az automatizált kutatás-fejlesztés gyorsíthatja az AI-képességek fejlődését, miközben lerövidítheti a biztonsági intézkedések kidolgozására rendelkezésre álló időt. Az…

A Grok 4.7 olcsóbban hozza az Opus 4.8 szintjét kódolásban
A Grok 4.7 a Senior SWE-Bench teszten 40,0 százalékos tasteful pass@3 eredményt ért el, ezzel holtversenyben hatodik lett. Az eredmény megegyezik az Opus 4.8…
ModellekA Parallel szerint felére csökkentette a kutatás idejét és költségét a GPT-6 Astra
A GPT-6 Astra a Parallel egyik tesztjében feleannyi idő alatt teljesített egy összetett webes kutatási feladatot, miközben a kódköltség nagyjából 50 százalékkal…

A New Relic szerint az AI gyorsítja a fejlesztést, de nehezíti a megfigyelést
A mesterséges intelligencia terjedése egyszerre gyorsítja a szoftverfejlesztést és növeli a rendszerek átláthatóságával kapcsolatos kockázatokat. A New Relic 2026-os…

Az UK AISI nyilvánosabbá teszi az MI-modellek teszteredményeit
Az Egyesült Királyság AI Security Institute-ja az EvalEval infrastruktúráját használja az MI-modellek értékelési eredményeinek nyilvános megosztására. A kezdeményezés…