Két európai nyílt modell érkezik a Cloudflare Workers AI-ra

A Cloudflare elérhetővé teszi a Workers AI platformon az EuroLLM és az Apertus európai nyílt modelleket. A vállalat emellett olyan képzéseket indít, amelyekkel kormányzati és kritikus infrastruktúrát üzemeltető szervezetek több modellre támaszkodó AI-védelmet építhetnek.
- Az EuroLLM 35 nyelvet támogat, köztük az EU mind a 24 hivatalos nyelvét.
- Az Apertust több mint 15 billió tokenen és több mint 1500 nyelven tanították.
- Mindkét modell elérhetővé válik a Cloudflare Workers AI platformján.
- A Cloudflare több AI-modellt összehangoló, nyílt forrású biztonsági réteget készített.
- Az első modellfüggetlen AI-védelmi workshopot októberben tartják Szingapúrban.
Két európai modell kerül a platformra
A Cloudflare október 1-jei bejelentése szerint az EuroLLM és az Apertus is megérkezik a Workers AI-ra, az eléréshez már lehet hozzáférést kérni. Mindkét modellt európai állami egyetemek és kutatóintézetek fejlesztették.
Az EuroLLM 35 nyelvet támogat, köztük az Európai Unió mind a 24 hivatalos nyelvét. A fejlesztésben az Instituto Superior Técnico, az University of Edinburgh, az Instituto de Telecomunicações, az Université Paris-Saclay, az Unbabel, a Sorbonne University, a Naver Labs és az University of Amsterdam vett részt. A projektet a Horizon Europe, az European Research Council és az EuroHPC támogatta, a modellt pedig a MareNostrum 5 szuperszámítógépen tanították be.
A konzorcium állítása szerint az EuroLLM hasonló méretű modelleknél jobb eredményeket ér el uniós többnyelvű mércéken és gépi fordításban. A Cloudflare szerint a modell számos olyan nyelvet is lefed, amelyet a jelenlegi nyílt modellek kevésbé támogatnak.
Az Apertus Svájc első nagyméretű, teljesen nyílt, többnyelvű nyelvi modellje. Több mint 15 billió tokenen, több mint 1500 nyelven tanították, a tanítási adatok 40 százaléka pedig nem angol nyelvű. A modellt az ETH Zurich, az EPFL és a Swiss National Supercomputing Centre fejlesztette a Swiss AI Initiative részeként.
Az Apertus architektúráját, súlyait, tanítási adatait és módszereit is közzétették. A fejlesztők az EU AI Act és a GDPR szempontjait is figyelembe vették, többek között a tanításból való kimaradási kérelmek, a személyes adatok eltávolítása és a memorizálás megelőzése terén. A modellt a CSCS Alps szuperszámítógépén, több mint 10 000 GH200 GPU használatával tanították.
A Cloudflare szerint a választási lehetőség biztonsági kérdés is
A vállalat tavaly az AI-szuverenitásról szóló vitában azt az álláspontot képviselte, hogy az országoknak szabadon kell kiválasztaniuk a feladathoz megfelelő eszközöket, és szükség esetén váltaniuk kell tudni. A Cloudflare szerint az elmúlt évben az AI-hozzáférés földrajzi korlátozásai, a frontier modellek kiberbiztonsági használata és a nyílt modellek korlátozására irányuló felhívások egyaránt erősödtek.
A cég úgy véli, egyetlen vállalattól egyetlen országnak sem kellene függenie az AI területén, és ezt saját magára is vonatkoztatja. A Cloudflare szerint India, Japán és Szingapúr nyílt modellekre épített, miközben az ázsiai és csendes-óceáni térségben többek között vidéki lakosokat, idős betegeket és ápolókat segítő eszközök készültek.
A vállalat a nyílt szabványokat és a szolgáltatói függés elkerülését is ennek a megközelítésnek a részeként említi. Hálózata több mint 335 városban, több mint 125 országban működik, AI-következtetéshez használható GPU-k pedig több mint 230 helyen állnak rendelkezésre.
Három példa a tavalyi modellek használatára
A Cloudflare szerint az ázsiai és csendes-óceáni térségben több száz diák, startup, kisvállalkozás és közalkalmazott épített alkalmazásokat a korábban hozzáadott nemzeti modellekre. A vállalat három példát emelt ki.
- Form Mitra, India: az Indian Institute of Technology Delhi hallgatói olyan hangvezérelt asszisztenst készítettek, amely 22 indiai nyelven segít kitölteni a nehezen érthető támogatási űrlapokat.
- MedBridge, Szingapúr: az eszköz 14 nyelven, köztük a hokkien és a kantoni nyelven támogatja az egészségügyi beszélgetéseket az idős betegek és az ápolók között.
- Anshin Concierge, Japán: a hackathonon készült prototípus a felhasználó saját szavaiból próbálja azonosítani a problémát, majd egy koppintással a megfelelő tokiói önkormányzati ügyfélszolgálathoz irányítja.
Modellfüggetlen AI-védelmet tanítanak
A Cloudflare biztonsági csapata az elmúlt évben olyan rendszert fejlesztett, amely több AI-modellt hangol össze a sérülékenységek keresésére, az eredmények ellenőrzésére és a fenyegetések rangsorolására. A vállalat közzétette a frontier és a nyílt modellek közös használatáról szerzett tapasztalatait, a koordinációs réteget pedig nyílt forrásúvá tette.
A rendszer zárt és nyílt modellekkel egyaránt működik, ezért a Cloudflare szerint egy szolgáltatóhoz való hozzáférés elvesztése nem kapcsolja le automatikusan a védelmet. A cég most gyakorlati workshopokat indít kormányzati kiberbiztonsági ügynökségek és kritikus infrastruktúrát üzemeltető szervezetek számára. A résztvevők saját AI-biztonsági összehangoló réteget és többrétegű védelmet építenek, majd azt a saját szervezetük szabályaihoz igazíthatják.
Az első workshopot októberben, a Singapore International Cyber Week keretében rendezik meg. A Cloudflare szerint a modulok beilleszthetők nemzeti AI-képzési és kiberreziliencia-programokba. A szervezet az EuroLLM és az Apertus hozzáférési kérelmeit, valamint a biztonsági összehangoló réteg kipróbálását is várja.
Cloudflare: One year later: Sovereign AI and the fight for choice


