A Microsoft bemutatta a MAI-Thinking-1 gondolkodó modellt

Nyilvános előzetesben elérhető a Microsoft AI MAI-Thinking-1 nevű gondolkodó modellje a Microsoft Foundry platformon. A közepes méretű modell a Microsoft szerint erős eredményeket ér el matematikai, tudásalapú és programozási feladatokban.
- Nyilvános előzetesben elérhető a MAI-Thinking-1 a Microsoft Foundryban.
- A modell 35 milliárd aktív és nagyjából 1 billió összes paraméterrel rendelkezik.
- A Microsoft szerint a rendszer a SWE-Bench Pro teszten a Claude Opus 4.6 szintjén teljesít.
- Az AIME 2025 feladatsoron 97,0, az AIME 2026 teszten 94,5 százalékos eredményt ért el.
- A modell 256 ezer tokenes kontextusablakot és Chat Completions API-kompatibilitást kínál.
Közepes méret, erős kódolási teljesítmény
A Microsoft AI augusztus 12-én mutatta be a MAI-Thinking-1-et, amelyet a vállalat reasoning, vagyis összetett következtetési feladatokra tervezett modellként ír le. A rendszer 35 milliárd aktív és nagyjából 1 billió összes paraméterrel rendelkező, ritka Mixture of Experts felépítésű modell. Következtetéskor kisebb erőforrásigénnyel dolgozik, mint a lényegesen nagyobb modellek.
A Microsoft szerint a MAI-Thinking-1 a SWE-Bench Pro teszten hasonló szinten teljesít, mint a Claude Opus 4.6. A fejlesztők munkáját olyan tanítási környezetekkel támogatták, amelyek determinisztikusak, futtathatók, és valódi tesztkészletekkel értékelik a modell munkáját. A modell így több lépésből álló feladatokat gyakorolhatott, például kód olvasását, fájlok módosítását, tesztek futtatását, a hibák megfigyelését és a köztes problémák kezelését.
Matematikai teszteken és emberi értékelésben is vizsgálták
A MAI-Thinking-1 a Microsoft közlése szerint az AIME 2025 matematikai feladatsoron 97,0 százalékos, az AIME 2026 teszten pedig 94,5 százalékos eredményt ért el. A vállalat ezt a modell méretosztályában erős matematikai és tudományos következtetési képesség jeleként értékeli.
A Microsoft és a Surge nevű partner vak, páros emberi értékelést is végzett. A vizsgálat 1276 feladatot ölelt fel, egy- és többfordulós beszélgetésekben, sokféle felhasználási helyzetben. A közlés szerint az értékelők a MAI-Thinking-1 válaszait előnyben részesítették a Claude Sonnet 4.6 válaszaival szemben. A tesztben többek között azt vizsgálták, hogy a modell mennyire érti a feladatot, követi az utasításokat, megfelelő részletességgel válaszol, világosan fogalmaz, és valóban előreviszi-e a felhasználó célját.
Vállalati használatra és ellenőrizhetőségre építettek
A MAI-Thinking-1 256 ezer tokenes kontextusablakot támogat, amely a Microsoft szerint elegendő egy 600 oldalas dokumentum kezeléséhez. A modell képes függvényhívásra, támogatja a fejlesztői utasítások hozzáadását, és kompatibilis a széles körben használt Chat Completions API-val. A Microsoft Foundry integrált értékelési, megfigyelési, biztonsági és telepítési képességeket kínál a modellhez.
A Microsoft hangsúlyozza, hogy a modellt külső laborok modelljeiből végzett lepárlás, vagyis distillation nélkül tanították. A vállalat saját állítása szerint tiszta, nyomon követhető, vállalati szintű adatokból dolgoztak, és a teljes technológiai láncon belüli önállóságra törekedtek. Ebbe beletartozik a Microsoft saját gyorsítóival közösen tervezett modell, a házon belüli tanítási infrastruktúra és a megerősítéses tanulási keretrendszer.
A MAI-Thinking-1 jelenleg nyilvános előzetesként érhető el a Microsoft Foundryban, ahol a Playground felületén is kipróbálható. A Microsoft szerint minden MAI-modell vállalati szintű biztonsági és megfelelőségi védelmet kap a platformon keresztül. A vállalat a biztonsági és képességbeli tanítást ugyanabban a megerősítéses tanulási infrastruktúrában végzi, hogy a modell az érzékeny kéréseknél biztonsági korlátokat tartson, a nem érzékeny tartalmaknál pedig hasznos maradjon.
Microsoft AI: Introducing MAI-Thinking-1 | Microsoft AI

