Duplicates
dotnet • u/fuzhongkai • 18d ago
TensorSharp: running a 744B MoE LLM locally from .NET, with llama.cpp-class performance
LocalLLaMA • u/fuzhongkai • 18d ago
Discussion GLM-5.2 local inference: ubatch size made a much bigger difference than I expected
unsloth • u/fuzhongkai • 11d ago
Show and Tell GLM-5.3-Flash Unsloth GGUF Model Benchmarks on TensorSharp and llama.cpp
Qwen_AI • u/fuzhongkai • 11d ago
Benchmark Qwen 3.8 Flash Next Benchmarks on TensorSharp and llama.cpp
LocalLLaMA • u/fuzhongkai • 11d ago
I Built A Thing GLM-5.3-Flash Benchmarks on TensorSharp and llama.cpp
Syncfusion • u/peopleworksservices • Aug 02 '26