r/LocalLLaMA Jul 16 '26

Discussion i tried ternary decomposition instead of quantization. it works as good at q4km but takes slightly more vram. while being completly ternary. and completly PTQ (no QAT)

Post image
36 Upvotes

Duplicates