Contatore di token per prompt IA

Incolla il prompt o il testo e ottieni una stima del numero di token con un intervallo realistico. I valori si basano su misurazioni fatte con i tokenizer di OpenAI per la lingua scelta. Il testo resta nel browser.

Incolla con Ctrl+V. Il conteggio si aggiorna in tempo reale mentre scrivi.

Il tuo testo resta nel browser: non viene inviato, non viene salvato e non compare nell’indirizzo della pagina.

A parità di caratteri, il tedesco richiede circa il 15% di token in più rispetto all’inglese.
I dati inseriti vengono salvati solo in questo browser.

Risultato

Token stimati
≈ 77
Intervallo tipico
da 66 a 90 token
Caratteri
298
Caratteri senza spazi
249
Parole
49
Righe
3
È una stima, non un conteggio esatto: ogni modello IA divide il testo con il proprio tokenizer. L’intervallo copre l’80–90% dei nostri testi di misura (OpenAI o200k_base e cl100k_base).

Come si calcola

I token sono le unità in cui un modello linguistico suddivide il testo: parole intere, parti di parole, segni di punteggiatura o spazi. Fatturazione e limiti (finestra di contesto, lunghezza massima della risposta) si misurano in token, non in caratteri.

Regola pratica: circa 4 caratteri per token, in inglese

OpenAI indica per il suo tokenizer tiktoken una media di circa 4 byte per token; Google dichiara per Gemini «circa 4 caratteri» per token. Entrambi i valori valgono per il testo in inglese. Le altre lingue richiedono più token, perché i tokenizer sono addestrati per lo più su testo inglese e parole come «biblioteca comunale» si spezzano in più pezzi.

Da dove vengono questi numeri

Abbiamo misurato i tokenizer di OpenAI o200k_base (GPT-4o e successivi) e cl100k_base (GPT-4, GPT-3.5) su 39–56 testi per lingua (misurazione del 27 settembre 2026). Caratteri per token in media:

La stima divide il numero di caratteri per la media dei due tokenizer; l’intervallo usa il 10° e il 90° percentile dei singoli testi. Codice di programmazione, tabelle, molti numeri, emoji o lingue con scrittura diversa (cinese, arabo…) possono discostarsi parecchio.

Perché non un contatore esatto?

Un tokenizer esatto dovrebbe caricare l’intera tabella dei token – per o200k_base circa 3,6 MB. Sarebbe sproporzionato per una pagina veloce. Inoltre Claude, Gemini e Llama usano tokenizer propri; solo il rispettivo fornitore dà cifre esatte (ad esempio tramite un’interfaccia di conteggio dei token).

Domande frequenti

Quanti token sono 1.000 parole?

In inglese, circa 1.300–1.400 token (misurato: in media 1,4 token per parola). Il tedesco ne richiede di più: a seconda del tokenizer, 1,8–2,1 token per parola, quindi circa 1.800–2.100 token.

Il conteggio è esatto per ChatGPT?

No, è una stima basata su misurazioni con i tokenizer di ChatGPT. Nei nostri testi di misura, l’80–90% dei valori reali rientrava nell’intervallo mostrato; il valore centrale si scostava, in mediana, del 6–12%.

Vale anche per Claude o Gemini?

A grandi linee sì, ma ogni modello ha un proprio tokenizer. Anche Google indica per Gemini circa 4 caratteri per token in inglese. Per una cifra esatta serve l’interfaccia del rispettivo fornitore, ad esempio un endpoint di conteggio token di OpenAI, Claude o Gemini.

Il testo viene caricato da qualche parte?

No. Il conteggio avviene solo nel browser: il testo non viene inviato, non viene salvato e non finisce nella barra degli indirizzi.

Perché contano anche spazi e a capo?

Anche i tokenizer elaborano gli spazi: uno spazio di solito si attacca alla parola successiva, mentre più spazi o a capo consecutivi diventano token a sé. Per questo la stima parte da tutti i caratteri.

Fonti e riferimenti normativi

Aggiornato al:

Strumenti correlati