Contador de tokens para prompts de IA

Pega tu prompt o texto y verás una estimación del número de tokens con un rango realista. Los valores se basan en mediciones con los tokenizadores de OpenAI para el idioma elegido. Tu texto se queda en el navegador.

Pega el texto con Ctrl+V. El recuento se actualiza mientras escribes.

Tu texto se queda en tu navegador: no se envía, no se guarda y no aparece en la dirección de la página.

El alemán necesita, con el mismo número de caracteres, alrededor de un 15 % más de tokens que el inglés.

Resultado

Tokens estimados
≈ 78
Rango habitual
de 65 a 94 tokens
Caracteres
273
Caracteres sin espacios
225
Palabras
48
Líneas
3
Es una estimación, no un recuento exacto: cada modelo de IA divide el texto con su propio tokenizador. El rango cubrió el 80–90 % de nuestros textos de medición (OpenAI o200k_base y cl100k_base).

Cómo se calcula

Los tokens son las unidades en las que un modelo de lenguaje divide el texto: palabras completas, partes de palabras, signos de puntuación o espacios. Lo que se cobra y se limita (ventana de contexto, longitud máxima de la respuesta) se mide en tokens, no en caracteres.

Regla general: unos 4 caracteres por token, en inglés

OpenAI indica sobre su tokenizador tiktoken que un token equivale, de media, a unos 4 bytes; Google señala para Gemini «unos 4 caracteres» por token. Ambas cifras se refieren al texto en inglés. Otros idiomas necesitan más tokens, porque los tokenizadores se entrenaron sobre todo con texto en inglés y palabras como «biblioteca municipal» se dividen en varias partes.

De dónde salen las cifras

Medimos los tokenizadores de OpenAI o200k_base (GPT-4o y posteriores) y cl100k_base (GPT-4, GPT-3.5) sobre 39 a 56 textos por idioma (datos del 27 de septiembre de 2026). Caracteres por token de media:

La estimación divide el número de caracteres entre la media de ambos tokenizadores; el rango usa el percentil 10 y el percentil 90 de los textos individuales. El código de programación, las tablas, muchos números, los emojis o los idiomas con otra escritura (chino, árabe…) pueden desviarse bastante.

¿Por qué no un contador exacto?

Un tokenizador exacto tendría que cargar la tabla completa de tokens: en el caso de o200k_base son unos 3,6 MB. Sería excesivo para una página rápida. Además, Claude, Gemini y Llama usan sus propios tokenizadores; solo el proveedor correspondiente ofrece cifras exactas (por ejemplo, mediante una interfaz de recuento de tokens).

Preguntas frecuentes

¿Cuántos tokens son 1.000 palabras?

En inglés, unos 1.300–1.400 tokens (medido: de media 1,4 tokens por palabra). El alemán necesita más: según el tokenizador, entre 1,8 y 2,1 tokens por palabra, es decir, unos 1.800–2.100 tokens.

¿Es exacto el recuento para ChatGPT?

No, es una estimación basada en mediciones con los tokenizadores de ChatGPT. En nuestros textos de medición, entre el 80 % y el 90 % de los valores reales quedaron dentro del rango mostrado; la cifra central se desvió, en la mediana, entre un 6 % y un 12 %.

¿Vale también para Claude o Gemini?

A grandes rasgos sí, pero cada modelo tiene su propio tokenizador. Google también indica para Gemini unos 4 caracteres por token en inglés. Solo obtendrás cifras exactas a través de la interfaz del proveedor correspondiente.

¿Se sube mi texto a algún servidor?

No. El recuento se hace solo en tu navegador: el texto no se envía, no se guarda y no se escribe en la barra de direcciones.

¿Por qué cuentan también los espacios y los saltos de línea?

Los tokenizadores también procesan los espacios en blanco: un espacio suele ir pegado a la palabra siguiente, y varios espacios o saltos de línea seguidos forman tokens propios. Por eso la estimación parte de todos los caracteres.

Fuentes y base legal

Última actualización:

Herramientas relacionadas