A Hugging Face nyílt modelljei egy kattintással telepíthetők a Foundryban

A Microsoft Foundry katalógusába érkeznek a Hugging Face válogatott, nyílt súlyú modelljei. A modellek előre előkészített Azure-tárhellyel, Microsoft által felépített és ellenőrzött futtatókörnyezettel, valamint egykattintásos telepítéssel használhatók a Foundry Managed Compute szolgáltatásában.
- A Hugging Face Collection a Microsoft Foundry heti frissítésű modellkatalógusába kerül.
- A modellek egy kattintással telepíthetők a Foundry Managed Compute környezetébe.
- A Microsoft ellenőrzi a licenceket, a futtatókódot és a konténereket.
- A súlyokat Azure-tárhelyen, a futtatóképeket Microsoft által kezelt regisztrációs tárban tárolják.
- A modellek privát hálózaton is telepíthetők a Hugging Face Hub elérése nélkül.
Hetente frissülő modellkatalógus
A bejelentést a Microsoft a Build 2026 konferencián ismertette, a Hugging Face pedig 2026. július 7-én tette közzé róla részletes anyagát. A Hugging Face Collection a platform modellkatalógusának válogatott részét alkotja, amelyet hetente frissítenek az ökoszisztéma felkapott modelljeivel.
A gyűjtemény többféle feladatra kínál modelleket. Ide tartoznak a csevegéshez és ügynöki alkalmazásokhoz használható nagy nyelvi és látási nyelvi modellek, a beszédfelismerő és beszédfordító rendszerek, a beágyazásra szolgáló modellek, a szegmentálási modellek, valamint a képgeneráló megoldások.
A Microsoft szerint a gyűjtemény minden modellje biztonsági ellenőrzésen esik át, és SafeTensors formátumú súlyokat használ. A katalógusba kerülő modelleknél nem engedélyezik a nem megbízható kód futtatását. A trust_remote_code használatát igénylő modelleket felülvizsgálják, szükség esetén módosítják, vagy kizárják.
A Managed Compute kezeli az üzemeltetést
A Foundry Managed Compute a Microsoft Foundry harmadik telepítési lehetősége a tokenenkénti díjazás és a kiépített átviteli kapacitás mellett. A szolgáltatás menedzselt GPU-platform nyílt forrású és egyedi modellekhez. A felhasználó a modell paraméterszámát, kontextushosszát és a késleltetésre vagy átviteli teljesítményre vonatkozó igényt adja meg, a GPU-topológiát pedig a Foundry kezeli.
A Microsoft automatikusan gondoskodik a támogatott futtatókörnyezetek frissítéseiről, verzióváltásairól és biztonsági javításairól. A felsorolt környezetek között szerepel a vLLM, az SGLang, a TensorRT-LLM, a NIM, a TEI és a llama.cpp. A modell beállítása, a telepítés működése és az útválasztás továbbra is a felhasználónál marad.
A Foundry különböző modelltelepítési módjai ugyanazt a végpontot, SDK-kat, hitelesítést, megfigyelhetőséget és számlázást használják. A nyílt súlyú modellek a Foundry Agents rendszerébe is ugyanúgy beköthetők, mint a többi modell, így egy ügynökön belül többféle modell kombinálható külön integrációs út nélkül.
Ellenőrzött futtatókörnyezet és privát telepítés
A Hugging Face és a Microsoft közös kiválasztási folyamatot használ. A jelölteket közösségi visszajelzések, partneri kérések és ügyféligények alapján azonosítják. Ezután megvizsgálják a licenceket a Microsoft vállalati terjesztési szabályai szerint, ellenőrzik a tárolókat egyedi végrehajtható kód és biztonsági kockázatok szempontjából, majd felépítik és sérülékenységekre vizsgálják a futtatókonténer-lemezképeket.
A modell súlyait egyszer töltik le a Hugging Face-ről, ellenőrzik a közzétett modellkártyával, majd a kiszolgálás régióiban Microsoft által kezelt Azure-tárhelyen helyezik el. A modellt, a futtatókörnyezetet és a gyorsító kombinációját API-kompatibilitás és teljesítmény alapján is tesztelik. A vizsgálatok kiterjednek többek között a késleltetésre, az átviteli teljesítményre, az első tokenig eltelt időre és a tokenek közötti dekódolási időre.
Mivel a súlyok és a futtatóképek már Microsoft által kezelt infrastruktúrán találhatók, a telepítéshez nincs szükség kimenő hálózati kapcsolatra a Hugging Face Hub felé. A forrás szerint így a modellek privát hálózaton belül is éles környezetbe telepíthetők.
Mit jelent ez a felhasználóknak?
A Hugging Face modelljei eddig nyílt súlyaik és testreszabhatóságuk miatt voltak vonzók, az üzemeltetéshez azonban modellválasztásra, licencellenőrzésre, GPU-méretezésre, futtatókörnyezet-építésre és biztonsági javításokra is szükség volt. A Microsoft által leírt megoldás ezeket a feladatokat a Foundry vállalati szolgáltatási rétegébe helyezi.
A fejlesztők így a Hugging Face ökoszisztémájából származó modelleket a Foundry egységes végpontján és eszközeivel használhatják, miközben a modellverziók rögzíthetők, a súlyok pedig a saját bérlőben, Microsoft által kezelt Azure-infrastruktúrán futnak. A Managed Compute globális és adatövezeti telepítéseket is kínál, utóbbiaknál az adatok elhelyezéséhez és szuverenitásához kapcsolódó szempontok kapnak szerepet.
Hugging Face: Hugging Face Models on Foundry Managed Compute


