Salta al contenuto principale

Prezzi snapshot 2026-05. Verifica su hetzner.com/cloud per quotazione corrente. I prezzi AWS e DigitalOcean sono stime on-demand EU. Questo tool non costituisce consulenza di acquisto.

Configura il Workload

Picco req/s previsto per l'app (escluso LLM inference)
OS + runtime + DB + cache + applicazione, senza LLM
Include OS, modelli LLM (llama3.1:8b ~5 GB), DB, log
Hetzner include 20-60 TB inclusi per tier

Modelli LLM da hostare (Ollama on-prem)

Seleziona i modelli da eseguire contemporaneamente. La RAM viene sommata.

Tier Raccomandato

CCX13
4 vCPU AMD 16 GB RAM 240 GB SSD 20 TB inclusi
€23.00/mese
Annuo:€276.00

Perche questo tier

RAM applicazione4 GB
RAM modelli LLM6 GB
Subtotale RAM10 GB
Buffer 30%+3 GB
RAM totale richiesta13 GB
Storage richiesto50 GB

Dimensionato per RAM (app + LLM + buffer 30%)

Confronto Provider Equivalenti

vs AWS on-demand EU (Frankfurt) e DigitalOcean Basic
Provider / IstanzaMensileAnnuovs Hetzner
Hetzner CCX13Raccomandato€23.00€276.00Riferimento
AWS t3.mediumAWS€30.00€360.00 +€7.00/mo
AWS t3.largeAWS€60.00€720.00 +€37.00/mo
AWS t3.xlargeAWS€120.00€1440.00 +€97.00/mo
DO Basic 4 GBDO€24.00€288.00 +€1.00/mo
DO Basic 8 GBDO€48.00€576.00 +€25.00/mo
DO Basic 16 GBDO€96.00€1152.00 +€73.00/mo
Risparmio Hetzner vs AWS equivalente: €84.00/anno

Tutti i Tier Hetzner CCX - AMD Dedicated vCPU

CCX23
8 vCPU · 32 GB RAM · 240 GB SSD
€36.00/mese
CCX33
16 vCPU · 64 GB RAM · 480 GB SSD
€72.00/mese
CCX43
32 vCPU · 128 GB RAM · 960 GB SSD
€144.00/mese

Nota: tutti i tier CCX usano CPU AMD EPYC dedicati (non condivisi a differenza dei CX shared). Per workload GPU/AI con alta concorrenza, considera Hetzner Robot con GPU dedicata (non disponibile in Cloud UI standard).

Come utilizzare VPS Hetzner Cost Calculator

1. Inserisci il workload

Imposta RPS target, RAM applicazione (senza LLM), storage totale e traffico mensile previsto. Puoi usare gli scenari precompilati "Scenario 3 LLM" o "API Production".

2. Seleziona i modelli LLM da hostare

Spunta i modelli Ollama on-prem che prevedi di eseguire in contemporanea (llama3.1:8b, qwen2.5:7b, mistral:7b, llava:7b). La RAM richiesta viene sommata.

3. Leggi il tier raccomandato

Il tool sceglie automaticamente il tier CCX minimo che soddisfa RAM totale (con buffer 30%), storage e RPS, e mostra costo mensile e annuo.

4. Confronta con AWS e DigitalOcean

Nella tabella di confronto verifica il risparmio stimato rispetto a istanze AWS t3 e droplet DigitalOcean con specifiche equivalenti.

Suggerimenti

  • Usa lo scenario "Scenario 3 LLM" per simulare un VPS che ospita piu modelli Ollama in contemporanea e verifica subito l'impatto sulla RAM totale.
  • Se prevedi crescita del traffico o dello storage, lascia margine: passare da un tier all'altro su Hetzner richiede un resize (breve downtime), non e' istantaneo.
  • Per workload GPU/AI ad alta concorrenza valuta Hetzner Robot con GPU dedicata, non disponibile nella Cloud UI standard su cui si basa questo calcolatore.

Domande frequenti

Come viene calcolato il tier CCX raccomandato?

Il tool somma RAM applicazione e RAM dei modelli LLM selezionati, applica un buffer del 30% per sistema operativo e cache, poi sceglie il primo tier Hetzner CCX (13/23/33/43) che ha RAM e storage sufficienti. Se nessun tier basta, propone il piu grande disponibile (CCX43).

Quanta RAM occupano i modelli LLM selezionabili?

Con quantizzazione Q4_K_M: llama3.1:8b circa 6 GB, qwen2.5:7b circa 5 GB, mistral:7b circa 5 GB, llava:7b (modello vision) circa 8 GB. Sono stime per esecuzione con Ollama on-prem, non per GPU dedicata.

I prezzi mostrati sono aggiornati?

I prezzi sono uno snapshot datato (visibile nel box disclaimer in alto) e vengono aggiornati periodicamente. Verifica sempre la quotazione corrente su hetzner.com/cloud prima di un acquisto: i prezzi AWS e DigitalOcean sono stime on-demand EU indicative.

Perche Hetzner CCX conviene rispetto ad AWS o DigitalOcean per workload simili?

I tier CCX usano vCPU AMD EPYC dedicati (non condivisi) a prezzo fisso mensile, con traffico incluso da 20 a 60 TB per tier. AWS on-demand e istanze burstable come t3 spesso costano di piu a parita' di RAM, e DigitalOcean ha CPU condivise sui piani Basic.

Cosa significano gli avvisi (warning) che appaiono sotto la raccomandazione?

Segnalano condizioni da verificare: LLM inference su CPU (latenza 10-60s per token senza GPU dedicata su CCX13), traffico dichiarato oltre 5.000 GB/mese, storage oltre l'80% del disco incluso nel tier, o necessita' di GPU dedicata per workload AI ad alto volume (disponibile solo su Hetzner Robot, non Cloud UI).