SGLang

Gyorsabb lehet a képfeldolgozó LFM2.5-VL modell
A Hugging Face bemutatta az LFM2.5-VL-DSpark megoldást, amely a képet és szöveget is kezelő modellek következtetését gyorsíthatja. A közzétett adatok szerint a gyorsulás…

A Liquid AI látásmodellje akár 3,13-szor gyorsabban dekódol
A Liquid AI bemutatta az LFM2.5-VL-DSpark kísérleti modellt, amely az LFM2.5-VL-3B látásnyelvi modell dekódolását gyorsítja. A vállalat mérései szerint a dekódolási…

Az NVIDIA tesztje szerint sok kódolóügynök elbukik éles kiszolgálásban
Az NVIDIA új SWE-Serve benchmarkja azt vizsgálja, hogy az AI-kódolóügynökök javításai működnek-e valódi modellkiszolgálás közben. A 19, éles szervert indító feladatnál a…

A Novita AI-ra érkezett a Qwen3.8 2.4T A95B, egymillió tokenes kontextussal
A Novita AI szerver nélküli API-ján elérhetővé tette a nyílt súlyú, csak szöveget kezelő Qwen3.8 2.4T A95B modellt. A rendszer egymillió tokenes kontextusablakot, 131…

Megjelent a Qwen3.8-2.4T-A95B, már a Modalon is elérhető
A Qwen3.8-2.4T-A95B nyílt súlyú modellként jelent meg, és már a Modal felhőplatformján is elérhető. A szolgáltató szerint az új modell több területen is javult a Qwen…

A Hugging Face nyílt modelljei egy kattintással telepíthetők a Foundryban
A Microsoft Foundry katalógusába érkeznek a Hugging Face válogatott, nyílt súlyú modelljei. A modellek előre előkészített Azure-tárhellyel, Microsoft által felépített és…