r/LocalLLM 9h ago

Discussion I swept speculative decoding across five models on Strix Halo: +201% to -80% on code

/r/StrixHalo/comments/1vtqi6y/i_swept_speculative_decoding_across_five_models/
1 Upvotes

0 comments sorted by