Salta al contenuto principale

Dati aggiornati a maggio 2026. VRAM calcolata per quantizzazione Q4_K_M. Throughput stimato su CPU AMD EPYC (Hetzner CCX). Verifica i requisiti ufficiali su HuggingFace prima del deploy.

Modelli compatibili

#ModelloParamVRAM Q4ThroughputLicenzaFine-tuneMaturityRiskScore
1Llama 3.2 3BLLaMA 3GGUF3B2 GB35 t/s LLaMA 3 qlora
82.0%
medium
65.6%
2Llama 3.1 8BLLaMA 3GGUF8B4.7 GB18 t/s LLaMA 3 qlora
92.0%
medium
65.2%
3Mistral 7B v0.3MistralGGUF7B4.1 GB20 t/s Apache 2.0 qlora
90.0%
low
65.0%
4Gemma 2 9BGemmaGGUF9B5.5 GB15 t/s Gemma lora
86.0%
medium
62.8%
5Aya 23 8BAyaGGUF8B4.7 GB17 t/s Apache 2.0 lora
77.0%
medium
60.5%

Come viene calcolato lo Score

  • Maturity (30%)Stabilità benchmark MTEB e supporto community
  • Licenza commerciale (20%)Uso commerciale consentito senza restrizioni
  • Throughput (30%)Token/s sul VPS selezionato (normalizzati su 150 t/s max)
  • Use case match (20%)Match primario (100%) o secondario (70%) con use case

Come utilizzare SLM Picker

1. Seleziona la dimensione del VPS Hetzner

Scegli CCX13/22/32/52: il tool filtra automaticamente solo i modelli compatibili con la RAM disponibile su quel piano.

2. Imposta use case e lingue target

Scegli lo use case principale (chat, RAG, code, translation...) e le lingue europee che ti servono. Nessuna lingua selezionata = tutti i modelli.

3. Affina con licenza e dimensione massima

Attiva "Solo licenze commerciali" se ti serve un uso commerciale senza restrizioni e limita la dimensione massima in miliardi di parametri.

4. Ordina la tabella e confronta i modelli

Clicca sulle colonne Param, Throughput, Maturity o Score per riordinare la tabella e scegliere il modello con il miglior compromesso per il tuo caso d'uso.

Suggerimenti

  • Per un uso commerciale, attiva sempre il filtro "Solo licenze commerciali" prima di scegliere un modello, anche se lo score sembra alto.
  • Se il tuo caso d'uso è RAG, privilegia i modelli con match use case primario piuttosto che il solo throughput massimo.
  • Su VPS piccoli (CCX13) preferisci modelli con dimensione ≤7B per mantenere un throughput utilizzabile in produzione.

Domande frequenti

Come viene calcolato lo Score complessivo di ogni modello?

È una media pesata di 4 fattori: maturity (30%, stabilità benchmark e supporto community), licenza commerciale (20%), throughput normalizzato sul VPS selezionato (30%) e match con lo use case scelto (20%, 100% se primario, 70% se secondario).

Cosa indica il Risk score (low/medium/high)?

È un indicatore composito di rischio calcolato sui dati del catalogo del modello (sicurezza, licenza, maturità): un rischio "high" segnala un modello meno maturo o con vincoli di licenza da valutare con attenzione prima del deploy.

Il throughput mostrato cambia in base al VPS che scelgo?

Sì, la colonna Throughput mostra i token al secondo stimati specificamente per la dimensione Hetzner CCX selezionata (CCX13/22/32/52): cambiando VPS la tabella si ricalcola.

Cosa succede se non seleziono nessuna lingua target?

Il filtro lingua è opzionale: se non selezioni nessuna lingua, il tool mostra tutti i modelli disponibili indipendentemente dalle lingue supportate.

I dati di VRAM e throughput sono affidabili per un deploy in produzione?

Sono stime aggiornate a maggio 2026, calcolate per quantizzazione Q4_K_M su CPU AMD EPYC (Hetzner CCX): prima del deploy in produzione verifica sempre i requisiti ufficiali del modello su HuggingFace.