help wantedhigh priority
Repository-Metriken
- Stars
- (124.222 Sterne)
- PR-Merge-Metriken
- (Durchschn. Merge 6T 8h) (389 gemergte PRs in 30 T)
Beschreibung
We're doing some work over at https://github.com/huggingface/candle to improve our Metal backend, I've been collecting various gputraces for the different frameworks and was wondering if there was a documented/known way to generate one for llama.cpp during model inference.
Specifically talking about this type of debugger output: https://developer.apple.com/documentation/xcode/metal-debugger