SLM Picker - Scegli il Modello AI per il Tuo VPS Hetzner
Filtra e confronta oltre 18 Small Language Model open-weight compatibili con Hetzner CCX13/22/32/52. Rank per throughput, maturity, licenza e lingue europee target.
Dati aggiornati a maggio 2026. VRAM calcolata per quantizzazione Q4_K_M. Throughput stimato su CPU AMD EPYC (Hetzner CCX). Verifica i requisiti ufficiali su HuggingFace prima del deploy.
Modelli compatibili
| # | Modello | Param | VRAM Q4 | Throughput | Licenza | Fine-tune | Maturity | Risk | Score |
|---|---|---|---|---|---|---|---|---|---|
| 1 | Llama 3.2 3BLLaMA 3GGUF | 3B | 2 GB | 35 t/s | LLaMA 3 | qlora | medium | ||
| 2 | Llama 3.1 8BLLaMA 3GGUF | 8B | 4.7 GB | 18 t/s | LLaMA 3 | qlora | medium | ||
| 3 | Mistral 7B v0.3MistralGGUF | 7B | 4.1 GB | 20 t/s | Apache 2.0 | qlora | low | ||
| 4 | Gemma 2 9BGemmaGGUF | 9B | 5.5 GB | 15 t/s | Gemma | lora | medium | ||
| 5 | Aya 23 8BAyaGGUF | 8B | 4.7 GB | 17 t/s | Apache 2.0 | lora | medium |
Come viene calcolato lo Score
- Maturity (30%)Stabilità benchmark MTEB e supporto community
- Licenza commerciale (20%)Uso commerciale consentito senza restrizioni
- Throughput (30%)Token/s sul VPS selezionato (normalizzati su 150 t/s max)
- Use case match (20%)Match primario (100%) o secondario (70%) con use case
Come utilizzare SLM Picker
1. Seleziona la dimensione del VPS Hetzner
Scegli CCX13/22/32/52: il tool filtra automaticamente solo i modelli compatibili con la RAM disponibile su quel piano.
2. Imposta use case e lingue target
Scegli lo use case principale (chat, RAG, code, translation...) e le lingue europee che ti servono. Nessuna lingua selezionata = tutti i modelli.
3. Affina con licenza e dimensione massima
Attiva "Solo licenze commerciali" se ti serve un uso commerciale senza restrizioni e limita la dimensione massima in miliardi di parametri.
4. Ordina la tabella e confronta i modelli
Clicca sulle colonne Param, Throughput, Maturity o Score per riordinare la tabella e scegliere il modello con il miglior compromesso per il tuo caso d'uso.
Suggerimenti
- Per un uso commerciale, attiva sempre il filtro "Solo licenze commerciali" prima di scegliere un modello, anche se lo score sembra alto.
- Se il tuo caso d'uso è RAG, privilegia i modelli con match use case primario piuttosto che il solo throughput massimo.
- Su VPS piccoli (CCX13) preferisci modelli con dimensione ≤7B per mantenere un throughput utilizzabile in produzione.
Domande frequenti
Come viene calcolato lo Score complessivo di ogni modello?
È una media pesata di 4 fattori: maturity (30%, stabilità benchmark e supporto community), licenza commerciale (20%), throughput normalizzato sul VPS selezionato (30%) e match con lo use case scelto (20%, 100% se primario, 70% se secondario).
Cosa indica il Risk score (low/medium/high)?
È un indicatore composito di rischio calcolato sui dati del catalogo del modello (sicurezza, licenza, maturità): un rischio "high" segnala un modello meno maturo o con vincoli di licenza da valutare con attenzione prima del deploy.
Il throughput mostrato cambia in base al VPS che scelgo?
Sì, la colonna Throughput mostra i token al secondo stimati specificamente per la dimensione Hetzner CCX selezionata (CCX13/22/32/52): cambiando VPS la tabella si ricalcola.
Cosa succede se non seleziono nessuna lingua target?
Il filtro lingua è opzionale: se non selezioni nessuna lingua, il tool mostra tutti i modelli disponibili indipendentemente dalle lingue supportate.
I dati di VRAM e throughput sono affidabili per un deploy in produzione?
Sono stime aggiornate a maggio 2026, calcolate per quantizzazione Q4_K_M su CPU AMD EPYC (Hetzner CCX): prima del deploy in produzione verifica sempre i requisiti ufficiali del modello su HuggingFace.