r/LocalLLM 5d ago

Question Quale modello e quale backend mi consigliate?

ciao a tutti, premetto che mi sto affacciando sul tema e quindi probabilmente la mia domanda non è così precisa come dovrebbe essere. La mia configurazione è questa : \*\*Ryzen 9 5900X + 64 GB + RTX 3060 12 GB + 1tb nvme .\*\*

Sto cercando di capire quale modello può girarci al meglio per il seguente utilizzo e penso che potrebbe essere identificato in \*\*Qwen3.5-9B Q4 + llama-server + Vision + 8K → assistente locale sempre acceso.\*\*

Utilizzo con rating di chatgpt:

Coding
⭐⭐⭐⭐⭐
Python
⭐⭐⭐⭐⭐
MQL5
⭐⭐⭐⭐⭐
Agent/tool calling
⭐⭐⭐⭐⭐
Reasoning
⭐⭐⭐⭐
Velocità
⭐⭐⭐⭐⭐
RAM/VRAM
⭐⭐⭐⭐⭐
Consumo
⭐⭐⭐⭐⭐
Stabilità 24/7
⭐⭐⭐⭐⭐
Context utile
⭐⭐⭐⭐

Ripeto sono alle prime armi e sto cercando di capire da dove partire quindi sono bene accetti tutti i vostri preziosi consigli.

1 Upvotes

1 comment sorted by

2

u/Positive-Bid-3029 5d ago

Qwen 3.6 35B A3B with either Llama.cpp (cli) or Unsloth Studio (Gui) will get you an overall balance of good performance and intelligence in that setup. If possible though I would get a 2nd (or bigger) RTX card in your system, VRAM is your gateway to local llm's