Kimi K2.6

A Modal szerint trilliónyi token kiszolgálása kell a kódoló ügynökökhöz
A Modal olyan következtetési szolgáltatásokat üzemeltet kódoló AI-ügynökökhöz, amelyek naponta több százmilliárd, összesen pedig trilliónyi tokent dolgoznak fel. A…

Az MLPerfben először mértek adatközponti AI-ügynököt
Az MLPerf Inference v6.1 mérésében először szerepelt adatközponti hardveren futtatott ügynöki terhelés, a Lambda pedig egy ezermilliárdnál több paraméteres modellt…

Az NVIDIA Nemotron 3 Ultra vezeti az open modelleket RTL-kódolásban
Az NVIDIA Nemotron 3 Ultra az ACE-RTL ügynökkel együtt 97,1 százalékos átlagos megfelelési arányt ért el kilenc RTL-feladatkategóriában. A vállalat szerint a modell…