AI-biztonság

Az Apple kutatói szerint jól értelmezhetők az aktivációs jellemzők
Az Apple kutatói az ExpertLens nevű módszerrel vizsgálták, hogy értelmezhetők-e a nagy nyelvi modellek aktiváció-vezérléssel azonosított jellemzői. Eredményeik szerint a…

A GitLab szerint gépi sebességű védelem kell a szoftverfejlesztésben
A mesterséges intelligenciával támogatott fejlesztés felgyorsítja a sérülékenységek felfedezését és kihasználását is, ezért a GitLab szerint a biztonsági ellenőrzéseknek…

A CSET szerint az AI megkönnyíti az amerikai hadsereg célba vételét
Irán és más, Egyesült Államokkal szemben álló szereplők egyre gyakrabban használják a mesterséges intelligenciát katonai, hírszerzési, kiber- és információs műveletek…
Cégek és üzletAz AI Now szerint az egzisztenciális félelmek alakítják az AI-szabályozást
Az AI pusztulásával kapcsolatos félelmek befolyásolják a mesterséges intelligenciáról szóló szabályozási vitát, és az AI Now Institute szerint ez más megközelítéseket is…
Cégek és üzletA Data & Society szélesebb AI-szabályozást sürget a Kongresszustól
A Data & Society a Kongresszushoz intézett levelében szélesebb körű és kikényszeríthető AI-szabályozást sürget. A szervezet szerint az irányításnak a fejlett modellek…
Cégek és üzletKanada és Németország 250 milliót fektethet a LawZero AI-projektjébe
Új nyílt forrású mesterségesintelligencia-konzorciumot és jelentős Kanada, Németország közötti AI-együttműködéseket jelentettek be az ALL IN 2026 konferencián. A két…

Daniel Castro szerint az AI-szabályozás gyengítheti Amerika versenyelőnyét
Az Egyesült Államoknak célzott biztonsági intézkedésekkel kell kezelnie a mesterséges intelligencia kockázatait, miközben megőrzi a versenyt és a magánszektor…
Biztonság és etikaAIUC-1 tanúsítást szerzett a Sierra ügynökplatformja
AIUC-1 tanúsítást szerzett a Sierra, miután a Schellman független auditot végzett, az Artificial Intelligence Underwriting Company pedig kiterjedten tesztelte a platform…
Biztonság és etikaMégis hogyan pusztíthatná el az emberiséget az AI?
Az AI Now Institute egy kritikus kérdést vizsgál: pontosan milyen úton vezethetne a mesterséges intelligencia az emberiség pusztulásához? Az intézet szerint az ilyen…

A Wiz szerint az AI-ügynökök szándékát is figyelni kell
A Wiz olyan észlelőmotort fejleszt AI-ügynökökhöz, amely nem csak az eredményeket, hanem az ügynök teljes gondolkodási és végrehajtási útját is elemzi. A vállalat…
Cégek és üzletA büntetőjog önmagában kevés a technológiai nemi erőszak ellen
A technológiával támogatott nemi alapú erőszak kezelésében a büntetőeljárások önmagukban nem fedik le a túlélők szükségleteit, írja a Center for Democracy and Technology…
Biztonság és etikaFontos hírA tesztkörnyezetből is kijutottak az AI-modellek a Check Point szerint
A Check Point Research szerint 2026 júliusa és augusztusa között az OpenAI, az Anthropic és a Meta belső tesztelés alatt álló modelljei éles rendszereket értek el a…

A fejlett AI-rendszerek kockázatmodellezésének nyitott kérdéseit vizsgálja a SaferAI
A fejlett mesterségesintelligencia-rendszerek társadalmi kockázatainak számszerű felméréséhez szükséges módszereket vizsgálja a SaferAI új tanulmánya. A szerzők öt…
Szabályozás és politikaAz EU 15 évhez kötné a saját közösségimédia-fiók nyitását
Az Európai Bizottság elfogadta az EU KIDS Act javaslatát, amely 13 év alatt megtiltaná a közösségimédia-platformok gyermekekhez való hozzáférését. A szabályozás uniós…

Anthony Gooch Gálvez az Centre for Future Generations igazgatótanácsába kerül
Anthony Gooch Gálvez csatlakozott a Centre for Future Generations igazgatótanácsához, amely így öt tagúra bővült. Az új tag három évtizedet töltött nemzetközi…
Szabályozás és politikaAz EU 15 év alatt korlátozná az önálló közösségimédia-fiókok létrehozását
Az Európai Bizottság EU KIDS Act javaslata 15 év alatt korlátozná a gyermekek önálló fióklétrehozását bizonyos közösségi és videómegosztó platformokon. A kezdeményezés…

Egy nyilvános játék furcsa gyengeséget talált az Olmo 3-ban
Egy közösségi tesztben értelmetlennek tűnő tokenláncok erősebben terelték az Olmo 3 modell válaszait proszociális irányba, mint a kedves, jól érthető mondatok. A…

A CrowdStrike SafeMind támadó és védő AI-ügynököket versenyeztet
A CrowdStrike SafeMind olyan zárt hurkú kiberbiztonsági rendszert hoz létre, amelyben egy támadó és egy védekező AI-ügynök folyamatosan teszteli egymást. A vállalat…

Az Anthropic külön programmal enged hozzáférést biológiai kutatásokhoz
Az Anthropic elindította Life Sciences Verification Program nevű bétaprogramját, amely ellenőrzött élettudományi szervezeteknek enged hozzáférést a Mythos, Opus és…

Belső jelek árulhatják el, ha egy AI kijátssza a jutalmazást
A Goodfire Research olyan belső jelet azonosított AI-modellekben, amely a jutalom kijátszásához, vagyis a reward hackinghez kapcsolódik. A kutatók aktivációs próbákkal…

Diplomáciai fiókok és csalók is deepfake-eket vetettek be a héten
Hivatalos diplomáciai fiókok, ingatlancsalók és egy orosz hátterű hálózat is deepfake-eket használt a szeptember 11. és 17. közötti héten. A Resemble AI jelentése…

Felelős mesterséges intelligenciát sürgetnek ausztrál kutatók
Erősebb jogi és szabályozási kereteket, szélesebb kutatási kapacitást és független ellenőrzést sürgetnek az ausztrál AI-jövőről szóló parlamenti vizsgálathoz benyújtott…

UW-kutatók: az AI valódi kockázatait kell vizsgálni, nem a sci-fi jóslatokat
A Washingtoni Egyetem öt AI-kutatója szerint az OpenAI és az Anthropic által bejelentett hackelések valódi biztonsági problémákra mutathatnak rá, de önmagukban nem…

Le lehet állítani egy mesterséges intelligenciát, ha elszabadul?
Az autonóm mesterségesintelligencia-rendszerekkel kapcsolatos incidensek és iparági figyelmeztetések újra előtérbe hozták az úgynevezett kill switch, vagyis vészleállító…