AI-biztonság

Kalifornia szakértőkkel készítene vészleállítót a fejlett AI-modellekhez
Kalifornia négy technológiai és kormányzási szakértőt von be a fejlett mesterségesintelligencia-modellek ellenőrzésére, valamint egy lehetséges vészleállító, úgynevezett…

Kilenc ajánlást tett Kanada AI-átláthatósági konzultációjára az SRI
A Schwartz Reisman Institute kilenc ajánlást nyújtott be a kanadai kormány mesterséges intelligenciáról szóló konzultációjára. Az intézet szerint az átláthatóság csak…
Szabályozás és politikaSam Altman az ENSZ-ben: az AI felett emberi kontrollra van szükség
Sam Altman, az OpenAI vezérigazgatója az ENSZ Biztonsági Tanácsában az AI gyors fejlődéséről, az emberi kontroll megőrzéséről és a nemzetközi biztonsági szabványok…

Az SAP szerint a felelős AI lehet az örökbefogadás kulcsa
Az SAP 3.0-s verzióra frissítette globális AI-etikai szabályzatát, amely a vállalat szerint az üzleti mesterséges intelligencia bevezetésének egyik legfontosabb…
KutatásAz OpenAI új benchmarkkal méri az AI mentális egészségügyi válaszait
Az OpenAI bemutatta a MentalHealthBench nevű, nyílt benchmarkot, amely azt méri, hogyan reagálnak az AI-rendszerek a mentális egészséggel kapcsolatos beszélgetésekben. A…

A filler tokenekkel sokkal jobban teljesít a GPT-6-Astra
A GPT-6-Astra jelentősen jobban teljesít több feladaton, ha a kérdéshez értelmetlen filler tokeneket, például pontokat illesztenek, miközben a modellnek azonnal kell…

Az Amazon szerint a Bee beszélgetéseihez csak a felhasználó fér hozzá
Az Amazon bemutatta a Bee Private Compute adatvédelmi architektúrát, amelynek célja, hogy a Bee személyes AI-val folytatott beszélgetések adataihoz alapértelmezés…
Biztonság és etikaKritikus biztonsági javításokat adott ki a GitLab
A GitLab kiadta a 19.4.1, 19.3.3 és 19.2.7 verziókat, amelyek több kritikus és magas súlyosságú biztonsági hibát javítanak. A vállalat az önállóan üzemeltetett…
Biztonság és etikaA FAR.AI szerint az AI meggyőzéssel is gyengítheti az emberi kontrollt
A FAR.AI egy új keretrendszerben vizsgálja, hogyan használhatja egy mesterséges intelligencia a kommunikációt úgy, hogy azzal gyengítse az emberek kontrollját az…

Gyors döntési modellt tesztelt a Vapi a hangalapú AI biztonságára
A Vapi a TypeSafe AI korai hozzáférésű Jev modelljét tesztelte arra, hogy a hangalapú AI-asszisztensek válaszai megszegnek-e egy előre megadott szabályt. A modell gyors…

Trump és Hszi az AI szabályozásáról tárgyalhat, két eltérő modell ütközik
Az AI biztonságáról és irányításáról egyeztethet Donald Trump amerikai elnök és Hszi Csin-ping kínai vezető szeptember 24-én Washingtonban. A találkozón két eltérő…

A LangSmith a klinikai ellenőrzést újrahasznosítható tesztekké alakítja
A LangChain szerint a LangSmith az egészségügyi AI-rendszerek klinikai ellenőrzését újrahasznosítható adatkészletekké, értékelőkké és kiadási ellenőrzésekké alakítja. Az…
Biztonság és etikaAI és az emberiség pusztulása: máshol látja a fő veszélyt az AI Now
Az AI Now Institute szerint a mesterséges intelligencia emberiséget elpusztító képességéről szóló félelmek elterelik a figyelmet a jelenlegi, konkrétabb kockázatokról.…

Microsoft: AI segítette az EvilTokens kiberbűnözői platformot
Az EvilTokens nevű kiberbűnözői platform a Microsoft szerint AI-t használt a támadási lánc több pontján, a postafiókok kompromittálásától a pénzügyi csalások…

Berkeley-i kutatók vezetik Kalifornia feltörekvő technológiákkal foglalkozó kiberbiztonsági csoportját
A Berkeley CLTC két kutatója, Nada Madkour és Deepika Raman lett a kaliforniai kiberbiztonsági munkacsoport feltörekvő technológiákkal foglalkozó albizottságának…

NVIDIA: alig lassult a titkosított DeepSeek-R1 futtatás B200 GPU-kon
A nagy nyelvi modellek érzékeny adatokon végzett inferenciájához az NVIDIA szerint úgy adható hardveres védelem, hogy közben a teljesítményveszteség mérsékelt marad. A…

A Darktrace tesztjében a mesterséges intelligencia hackeléssel próbált csalni
A Darktrace kutatói által végzett ellenőrzött tesztben több AI-ügynök is hackelési módszerekhez fordult, amikor egy kódolási feladatot nem tudott szabályosan…

529 ellenőrzött AI-ügynök-incidenst gyűjt az új AIR-regiszter
Az Anaconda által bemutatott Agent Incident Registry, röviden AIR, 529 ellenőrzött AI-ügynök-incidenst tart nyilván. Ezek közül 200 esetben tényleges kár érte valamelyik…

Az AI-kutatás automatizálása felgyorsíthatja a biztonsági kockázatokat
Az automatizált kutatás-fejlesztés gyorsíthatja az AI-képességek fejlődését, miközben lerövidítheti a biztonsági intézkedések kidolgozására rendelkezésre álló időt. Az…

A „sötét drónok” új kihívást jelentenek a légvédelemnek
A terephez közel repülő, kevés rádiófrekvenciás jelet kibocsátó drónok nehezen észlelhetők a légvédelmi rendszerek számára. A Shield AI Tracker C-UAS szoftvere…

A Zscaler csatlakozott az AI-ügynökök biztonságát célzó szövetséghez
A Zscaler alapító tagként csatlakozott a Blueprint Alliance-hoz, amely több beszállító együttműködésével fejleszt referenciaarchitektúrát a vállalati AI-ügynökök…

A Wiz ügynökintegrációkkal bővíti AI-biztonsági ökoszisztémáját
A Wiz ügynökintegrációkat vezet be a Wiz Model Context Protocolban, így a partneri AI-ügynökök igény szerint kérhetnek le biztonsági adatokat az ügyfelek…

A Lovable alapító tagként csatlakozott az AI-ügynökök biztonsági szövetségéhez
A Lovable alapító tagként csatlakozott a Blueprint Alliance-hoz, amely nyílt referencia-architektúrát dolgoz ki az AI-ügynökök nagyvállalati szintű védelméhez és…

Folyamatos AI-alapú kibervédelmi szolgáltatást indított a Palo Alto Networks
A Palo Alto Networks bemutatta a Unit 42 Continuous Frontier AI Defense szolgáltatást, amely AI-modellekkel és támadásszimulációval folyamatosan keresi, ellenőrzi és…