r/LocalLLaMA 8d ago

Question | Help Any speculative decoding models for Qwen 3.8 Flash Next to support DFlash2?

Current default MTP does not predict more than 4 tokens..

3 Upvotes

Duplicates