A Modular megnyitja a Mojo fordítóját, és hanggenerálást ad a MAX-hoz

A Modular 26.6-tól külső fejlesztők is hozzájárulhatnak a Mojo fordítójához, miközben a MAX platform hanggenerálással és új modellarchitektúrák támogatásával bővül. A kiadás az NVIDIA és AMD GPU-kon is teljesítményjavulásokat hoz.
- A Mojo 1.1 fordítóhoz már külső fejlesztők is küldhetnek hozzájárulásokat.
- A MAX 26.6 támogatja a MiniMax-Music3 szövegből zenei hangot generáló modellt.
- Új támogatást kapott az Inkling, valamint több Kimi, Qwen, Gemma és GLM modell.
- A Modular jelentős gyorsulásokat közölt NVIDIA B200 és AMD MI355 GPU-kon.
- A korábbi modular csomagot a kiadásban a max csomagok váltják fel.
Külső hozzájárulásokat fogad a Mojo fordító
A Modular szeptember 17-én tette közzé a Modular 26.6 kiadást. Ez az első verzió azóta, hogy a vállalat a ModCon rendezvényen nyílt forráskódúvá tette a Mojo fordítóját. A Modular 26.6-tal a projekt újabb szakaszba lép: a fejlesztők már külső hozzájárulásokat is küldhetnek a fordítóhoz.
A Mojo fordító forráskódja Apache 2.0 licenc alatt érhető el. A Modular emellett a belső hibajegyeket nyilvános GitHub-issue-kra költöztette, így a fejlesztők követhetik a folyamatban lévő munkát, és közvetlenül együttműködhetnek a vállalat csapatával.
A Mojo 1.1 javítja többek között a fordítási időt az implicit konverziók és a t-string literálok használatánál. A nyelvi szerver protokoll, vagyis az LSP fejlesztései javaslatokat adnak gyakori, egy karakterrel eltolt hibákra. A környezetfüggő típusfelismerés révén például a DType.float32 rövidebb, .float32 alakban is megadható, ha a típus kikövetkeztethető.
Hanggenerálással bővül a MAX
A MAX 26.6 új kimeneti módozatként támogatja a hanggenerálást. A funkció a szöveg-, kép- és látásalapú képességek mellé érkezik, és kezdetben a MiniMax-Music3 modellt támogatja. Ez egy szövegből zenét készítő modell, amely stílusleírás és dalszöveg alapján 44,1 kHz-es, sztereó hangot generál.
A hanggenerálás a /v1/audio/speech és a /v1/responses API-végpontokon keresztül érhető el. A felhasználók beállíthatják többek között a hanganyag hosszát, a zajcsökkentési lépések számát, a guidance scale értékét és a kimeneti formátumot.
A kiadás új modellarchitektúrákat is kezel. Ezek közé tartozik a Thinking Machines Inkling, vagyis az InklingForConditionalGeneration architektúra. A Modular emellett fejlesztéseket jelentett be a Kimi, Qwen, Gemma és GLM modellcsaládokhoz, valamint támogatást adott olyan spekulatív dekódolási eljárásokhoz, mint a DFlash és a DSpark. A MAX eszközhívási és adattípus-támogatása is javult.
Gyorsulás NVIDIA és AMD GPU-kon
A Modular szerint a MAX 26.6 több hardveren és munkaterhelésen is teljesítményjavulást kínál. NVIDIA B200 GPU-n a Gemma 4 dekódolási figyelmi műveletei legfeljebb 4,8-szor gyorsabbak, a MoE-útválasztás legfeljebb 7,9-szer gyorsabb, az alacsony kötegméretű NVFP4-kvantálás pedig legfeljebb 16-szor gyorsabb az összehasonlítási alapként használt értékhez képest.
AMD MI355 esetén a dekódolási figyelmi projekciók teljesítménye legfeljebb 6,6-szorosára javult. Az MXFP8 QKV-projekció a Modular közlése szerint legfeljebb 4,8-szor gyorsabb az előző kiadásnál.
A kiadás telepítéséhez a vállalat a mojo csomag frissítését, a MAX teljes csomagjához pedig a max[all] használatát javasolja. A korábbi modular csomagot ebben a verzióban kivezették. A fejlesztők igényeik szerint a max[serve] vagy a max[benchmark] csomagot is választhatják. A Modular közlése szerint a vállalat továbbra is dolgozik a MAX forráskódjának elérhetővé tételén, és 2026 vége felé tervezi elindítani ökoszisztéma-szövetségi programját.


