internettoolbox
← Volver a las herramientas

Calculadora de tokens para LLM

0 caracteres0 palabras

Cargando los tokenizadores…

CodificaciónLa usanTokensCoste
o200k_baseGPT-4o, GPT-4.1, serie o…–
cl100k_baseGPT-4, GPT-3.5-turbo, embeddings v3…–
estimación (caracteres ÷ 3,7)Claude, Gemini (tokenizador no público)0–

Cómo funciona

Pega cualquier texto (un prompt, un documento, una carga JSON) y mira cuántos tokens cuesta, calculados con los mismos tokenizadores BPE que OpenAI usa en producción: o200k_base (GPT-4o, GPT-4.1 y la serie o) y cl100k_base (GPT-4, GPT-3.5-turbo y los modelos de embeddings v3). Son recuentos exactos, no estimaciones: la herramienta ejecuta en tu navegador una versión en JavaScript puro de tiktoken.

Un token es la unidad por la que facturan las API de los LLM y con la que se miden las ventanas de contexto. No es ni un carácter ni una palabra: en inglés muchas palabras comunes son un solo token, las raras se dividen en varios, y los espacios y la puntuación se pegan de formas poco evidentes. Como regla general, la prosa en inglés ronda los 4 caracteres por token, el código unos 3, y las escrituras no latinas bastantes menos. Por eso calcular a ojo no es fiable, y por eso importa un recuento exacto cuando estás cerca del límite de contexto o estimas una factura.

Para Claude y Gemini no hay un tokenizador público, así que la herramienta muestra una estimación calibrada (caracteres ÷ 3,7, el promedio aceptado para prosa en inglés), etiquetada claramente como tal. Para presupuestar se queda dentro de un 10-15% en prosa; la cifra autorizada solo la da la respuesta de la API de cada proveedor.

Para calcular el coste de un prompt, escribe la tarifa de tu modelo en el campo “Precio $/1M tokens”, tomada de la página de precios actual de tu proveedor, y cada fila muestra el coste de este texto exacto. Los archivos de datos de los tokenizadores pesan unos pocos megabytes, se cargan una vez, solo en esta página, y después la PWA los guarda en caché. Tu texto nunca sale del navegador. Si intentas reducir un prompt con datos estructurados, pásalo por el JSON ⇄ TOON Converter de este sitio y vuelve a contar.

Preguntas frecuentes

¿Qué modelos usan o200k_base y cuáles cl100k_base?

o200k_base: GPT-4o, GPT-4o-mini, la familia GPT-4.1 y los modelos de razonamiento o1, o3 y o4. cl100k_base: GPT-4, GPT-4-turbo, GPT-3.5-turbo y text-embedding-3. Los modelos más nuevos de OpenAI suelen usar o200k_base; si dudas, cuenta con ambos, porque la diferencia suele ser pequeña.

¿Por qué el recuento de Claude y Gemini es una estimación?

Porque Anthropic y Google no publican sus tokenizadores. La heurística de caracteres ÷ 3,7 se ajusta a la prosa en inglés con un margen de entre el 10% y el 15%, mientras que el código y el texto en otros idiomas se desvían más. El recuento exacto llega en el campo usage de cada respuesta de la API; usa ese para las cifras que afecten a la facturación.

¿Cuántos tokens caben en una ventana de contexto?

Los que anuncie el modelo, menos tu presupuesto de salida: un modelo con 128k de contexto que lee un prompt de 120k tokens solo tiene unos 8k para responder. Los prompts de sistema, las definiciones de herramientas y el historial de la conversación cuentan contra la misma ventana.

¿Por qué mi texto corto cuenta más tokens de los esperados?

Porque las palabras poco habituales, los identificadores en camelCase, las URL, el base64 y las escrituras no latinas se fragmentan en muchos tokens pequeños, y un emoji puede costar entre 3 y 7 tokens. El JSON consume muchos tokens por la misma razón: cada comilla, cada llave y cada clave repetida se tokeniza. Justo eso es lo que el formato TOON (véase el JSON ⇄ TOON Converter) está pensado para arreglar.

¿Se sube mi texto para contar los tokens?

No. Los tokenizadores son JavaScript puro (el port gpt-tokenizer de tiktoken, de OpenAI) y se ejecutan en tu pestaña. La única actividad de red es la descarga de los propios archivos de datos del tokenizador la primera vez que abres la página; tu texto no genera ninguna petición.

¿Dónde encuentro el precio que debo introducir?

En la página de precios de tu proveedor: platform.openai.com/pricing, anthropic.com/pricing, ai.google.dev/pricing. Los precios cambian a menudo, así que la herramienta no los incluye fijos. Introduce la tarifa actual de tokens de entrada de tu modelo y, si necesitas ambos, calcula aparte el coste de salida.

Caracteres por token: calibración rápida por tipo de contenido

Usa estas proporciones para calcular a grandes rasgos antes de pegar el texto real.

Tipo de contenido≈ caracteres/token1000 tokens ≈
Prosa en inglés4,0~750 palabras
Prosa en español / francés / italiano / alemán3,5~600 palabras
Código fuente3,0~55 líneas
JSON minificado2,8~2,8 KB
Texto en chino / japonés1,5~500 caracteres
Datos en base64 / hexadecimal2,5~2,5 KB

Medido con o200k_base sobre muestras representativas; cada texto varía. Cuenta el texto real más arriba para obtener cifras exactas.

Cambiar de herramienta

Busca y abre cualquier herramienta