Az Anthropic beengedi az Accenture-t a frontier AI-modellek értékelésébe

Beágyazott, független értékelőkkel tenné ellenőrizhetőbbé frontier AI-modelljeinek biztonságát az Anthropic. A vállalat az Accenture-rel kötött partnerséget, amely modellteszteket, red-teaminget, igazodási vizsgálatokat és védelmi mechanizmusok tesztelését is magában foglalja.
- Az Anthropic az Accenture-rel indít független, beágyazott értékelést frontier AI-modellekre.
- A munkát a Faculty, az Accenture speciális AI-üzletága vezeti.
- A vizsgálatok modellértékelést, red-teaminget, igazodási teszteket és védelmi mechanizmusok ellenőrzését tartalmazzák.
- Az Anthropic és az Accenture legalább 1 milliárd dolláros kapacitásépítési befektetéssel számol öt év alatt.
- A partnerség nem kizárólagos, az Anthropic további értékelőket is bejelent a következő hetekben.
Mit vállal az Accenture az Anthropic mellett?
Az Anthropic 2026. szeptember 18-án jelentette be, hogy az Accenture-rel működik együtt a frontier AI független értékelésén. A cég szerint ez egy lépés annak a vállalásnak a teljesítése felé, amelyet a vezérigazgató We Must Pace the Frontier című esszéjében fogalmazott meg: értékelőket ágyaznának be az Anthropic működésébe.
A partnerséget a Faculty, az Accenture speciális AI-üzletága vezeti. A munka része lesz a modellek értékelése és red-teamingje, az igazodási vizsgálatok elvégzése, valamint a modellvédelmi mechanizmusok tesztelése.
Az Anthropic közlése szerint az Accenture sok iparágban segíti vállalatok és kormányok AI-bevezetését. A vállalat szerint ez a gyakorlati tapasztalat alakítja az Accenture biztonsági megközelítését, és ezt a nézőpontot hozza majd az Anthropic modelljeinek értékelésébe is.
Az Anthropic és az Accenture egyaránt arra számít, hogy a következő öt évben legalább 1 milliárd dollárt fektet kapacitásépítésbe ezen a területen.
Hogyan működne a beágyazott értékelés?
Az Anthropic szerint a beágyazott értékelés még új terület, és sok működési részlet kidolgozás alatt áll. A mai külső értékelőkkel szemben a beágyazott értékelők az AI-cégeken belül dolgoznának, a munkavállalókéhoz hasonló hozzáféréssel.
Ez a hozzáférés lehetővé tenné számukra, hogy kövessék, hogyan formálódnak a modellek a tanítás során, milyen döntések határozzák meg az építésüket és bevezetésüket, valamint közvetlenül beszéljenek az alkalmazottakkal. Az Anthropic szerint ebből a helyzetből az értékelők megvizsgálhatják a vállalat működését, ellenőrizhetik a biztonsági vállalások betartását, és feltárhatnak vakfoltokat.
A cég azt is írja, hogy az ilyen értékelők incidenseket jelenthetnek, és tájékozottabb képet adhatnak a nyilvánosságnak az előnyökről és a kockázatokról. Az Anthropic hangsúlyozza: a független beágyazott értékelők nem csökkentik a vállalat felelősségét, hanem ellenőrizhetőbbé teszik azt. A modellek biztonságáért továbbra is az Anthropic felel.
Még nincsenek közös szabályok
Az Anthropic szerint jelenleg nincsenek szabványok arra, hogy a beágyazott értékelők milyen információkhoz férjenek hozzá, illetve hogyan számoljanak be a megállapításaikról. A független értékelés finanszírozására sincs kialakult rendszer.
A vállalat hosszú távon azt tartaná kívánatosnak, ha a finanszírozás közös alapokból vagy kormányzati forrásokból érkezne, ahogyan azt a júniusi Advanced AI Framework dokumentumban is szorgalmazta. Mivel ilyen megoldás jelenleg nincs, az Anthropic különböző finanszírozási konstrukciók mellett tervez együtt dolgozni különböző értékelőkkel.
Az Accenture munkáját közvetlenül az Anthropic finanszírozza. A cég emellett párbeszédet folytat a METR-rel és más nonprofit értékelőkkel arról, hogy saját finanszírozással próbálják ki a beágyazott értékelés egyes elemeit.
Mit jelent ez a piacnak és a felhasználóknak?
Az Anthropic szerint a frontier AI-hoz olyan értékelői ökoszisztémára van szükség, amely közös szabványok szerint működik. A vállalat arra számít, hogy a frontier laborok egyszerre több szervezettel dolgoznak majd együtt.
A mostani partnerség nem kizárólagos: az Anthropic a következő hetekben további értékelőket jelent be, az Accenture pedig hasonló szerepkörben más AI-fejlesztőkkel is együtt fog működni.
A vállalat közlése szerint továbbra is tanít és kiad frontier modelleket, miközben független értékelőket szeretne maga mellett tudni. Az Anthropic azért osztja meg már most ezeket a korai lépéseket, hogy az emberek és más AI-fejlesztők lássák a folyamatát. A cég arra számít, hogy a megközelítése változni fog, ahogy a terület érettebbé válik, és további részleteket ígér a munka indulásakor, valamint új értékelők bevonásakor.
Anthropic: Partnering with Accenture on embedded evaluation


