Salta al contenuto principale

Testo da analizzare

0 / 50000 caratteri
Disclaimer accuratezza

Questo tool usa algoritmi di approssimazione BPE/SentencePiece. Il conteggio reale puo' differire del 10-15% rispetto ai tokenizer ufficiali (tiktoken, HuggingFace). Per conteggi esatti usare la libreria ufficiale del provider. I prezzi sono snapshot 2026-05 e possono variare.

Come funziona

Incolla il testo

Qualsiasi testo: prompt, codice, articolo, JSON. Fino a 50.000 caratteri.

Stima istantanea

Algoritmo regex BPE/SentencePiece con rilevamento automatico lingua IT/EN e testo tecnico.

Confronto costi

9 modelli ordinati per costo. Ollama on-prem sempre $0. Prezzi hardcoded snapshot 2026-05.

Come utilizzare Token Counter Multi-Model

Incolla il testo

Incolla o scrivi il testo, il prompt o il codice da analizzare nell'area di input (fino a 50.000 caratteri).

Scegli la modalita' di costo

Seleziona "Solo Input" per stimare solo il costo del prompt, oppure "Input + Output" per includere anche una preview dell'output atteso.

Leggi la tabella comparativa

La tabella mostra token, char/token e costo USD per 9 modelli LLM, ordinati per costo totale crescente. Ollama on-prem e' sempre segnalato a €0.

Suggerimenti

  • Attiva "Input + Output" e incolla una risposta tipica del modello per stimare il costo reale end-to-end, non solo il prompt.
  • Confronta sempre almeno un modello cloud economico e uno on-prem: la differenza di costo su volumi alti puo' essere di ordini di grandezza.
  • Se lavori con testo tecnico o codice, ricorda che il rapporto char/token e' tipicamente piu' basso che con prosa naturale: aspettati piu' token del previsto.

Domande frequenti

Quanto e' accurato il conteggio dei token?

Il tool usa un algoritmo di approssimazione BPE/SentencePiece con rilevamento automatico della lingua (IT/EN) e del testo tecnico. Lo scarto tipico e' del 10-15% rispetto ai tokenizer ufficiali (tiktoken per OpenAI, tokenizer HuggingFace per gli altri modelli). Per conteggi esatti usa sempre la libreria ufficiale del provider prima di andare in produzione.

Perche' lo stesso testo genera un numero diverso di token per modello?

Ogni famiglia di modelli usa un tokenizer diverso (BPE per GPT, SentencePiece per Llama/Mistral, encoding proprietari per Claude e Gemini) con vocabolari e regole di segmentazione differenti. Per questo lo stesso testo puo' produrre conteggi diversi anche del 20-30% tra un modello e l'altro, soprattutto su testo non inglese.

I prezzi mostrati sono aggiornati?

I prezzi per token sono uno snapshot del 2026-05 e sono hardcoded nel tool: i provider aggiornano i listini periodicamente, quindi verifica sempre il pricing ufficiale del provider prima di fare stime di budget definitive.

Cosa significa che Ollama on-prem costa sempre €0?

I modelli eseguiti localmente via Ollama (self-hosted, ad esempio su un VPS proprio) non hanno un costo per token perche' non passano da un'API a pagamento: il costo e' solo l'infrastruttura hardware, gia' pagata a monte. Per questo il tool li marca sempre come €0 e li mostra in cima all'ordinamento.

I miei dati vengono inviati a un server?

No. Il conteggio token e il calcolo del costo avvengono interamente lato client nel browser: nessuna chiamata API, nessun testo inviato al server. Puoi usare il tool anche con testo sensibile o prompt riservati.