JAX

Az NVIDIA szerint tízszer gyorsabb lett a dropless MoE tanítása JAX-ban
Az NVIDIA Transformer Engine JAX-szal kombinálva a vállalat mérése szerint 10,4-szeres teljesítménynövekedést hozott a dropless Mixture of Experts modellek tanításában.…

Világrekordot ért el az NVIDIA GB300 NVL72 MoE-modellek tanításában
Az NVIDIA szerint a GB300 NVL72 rackméretű rendszer világrekordot állított fel a DeepSeek-V3 671B kevert szakértői modell előtanításában. A 256 GPU-val végzett mérés…

A JAX host offloadinggal enyhíthető a GPU-memória szűkössége
A JAX host offloading a kiválasztott aktivációkat a GPU nagy sávszélességű memóriája helyett a processzor rögzített host memóriájában tárolja. Az NVIDIA mérései szerint…