CUDA
Fejlesztőknek
A PyTorch FBTriton kerneljei gyorsítják a táblás embeddingeket
A PyTorch bemutatta az FBTriton kerneltervezését, amely a Table-Batched Embedding műveleteit gyorsítja ajánlórendszerekben. A Triton-alapú megoldás a vállalat mérései…
A CUDA optimalizációs tudást vinné át Apple chipekre a K-Search
A Berkeley kutatói a K-Search nevű keresi és optimalizálja GPU-kernelfejlesztő rendszert MLX-támogatással bővítették. A cél, hogy a CUDA ökoszisztémában felhalmozott…