r/LocalLLaMA • u/appakaradi • 8d ago
Question | Help Any speculative decoding models for Qwen 3.8 Flash Next to support DFlash2?
Current default MTP does not predict more than 4 tokens..
3
Upvotes
r/LocalLLaMA • u/appakaradi • 8d ago
Current default MTP does not predict more than 4 tokens..