Revisada el 2026-10-09 · vigente hasta 2027-01-07

Un token es la unidad mínima de texto que procesa un modelo de lenguaje: una palabra, un trozo de palabra, un carácter o incluso un byte.1

Todo se mide en tokens: lo que cabe en la ventana de contexto, lo que se paga en la API y, de forma indirecta, lo que da de sí un plan de suscripción. La equivalencia con palabras no es fija: cambia con el idioma y con el tokenizador de cada modelo, y el de Claude cambió con Opus 4.7.12

Cómo funciona

  • Antes de procesarlo, el texto se codifica en una serie de tokens. El usuario no los ve, pero el modelo solo trabaja con ellos.1
  • Los tokens largos hacen más eficientes el entrenamiento y la inferencia; los cortos permiten manejar palabras raras o nuevas. El tokenizador elegido influye en el rendimiento y en el tamaño del vocabulario.1
  • No solo cuenta el texto del mensaje: también el prompt de sistema, las definiciones de herramientas, las imágenes, los PDF y el razonamiento del turno en curso.3 Usar herramientas añade además un prompt de sistema oculto de unos cientos de tokens (286 en Opus 5.5).4
  • Se pueden contar antes de enviar con el endpoint de conteo de la API. Es gratuito, da una estimación y cuenta con el tokenizador del modelo que se le indique.3

Cuántas palabras es un token

Anthropic da cifras distintas según la página, y solo para inglés:

FuenteEquivalencia
Glosario1 token ≈ 3,5 caracteres1
Preguntas frecuentes de precios1 token ≈ 4 caracteres o 0,75 palabras4
Página de modelos, tokenizador actual (desde Opus 4.7)1M tokens ≈ 555.000 palabras o 2,5M caracteres2
Página de modelos, tokenizador anterior1M tokens ≈ 750.000 palabras2
  • Las 0,75 palabras por token de la página de precios coinciden con el tokenizador anterior (750.000 palabras por millón). Con el actual salen unas 0,55 palabras por token: un texto de 1.000 palabras en inglés ronda los 1.800 tokens.24
  • Las páginas de precios y de conteo dicen que el tokenizador nuevo genera aproximadamente un 30 % más de tokens para el mismo texto, según el contenido. Lo usan los modelos Claude 4.7 y posteriores; Sonnet 4.6 y anteriores siguen con el antiguo.43 De las cifras de la página de modelos sale algo más, en torno a un 35 %.2
  • Para el español no hay cifra oficial; el glosario solo avisa de que la equivalencia varía con el idioma.1
  • Consejo oficial: no reutilizar conteos medidos con modelos anteriores, sino recontar con el modelo de destino.3

Por qué importan

  • Coste. La API cobra por millón de tokens (MTok), con precios distintos para entrada y salida. En Opus 5.5, 4 de salida: la salida cuesta cinco veces más.4 Con el tokenizador nuevo, el mismo texto da más tokens y la facturación refleja ese recuento.3
  • Referencias de tamaño de la propia documentación: una página web media (10 kB) ronda los 2.500 tokens; un artículo científico en PDF (500 kB), unos 125.000.4
  • Límites. La ventana y la salida máxima se miden en tokens: 1M y 128K en los modelos Claude actuales.2 Qué pasa al llenarla y cómo ahorrar, en ventana de contexto.
  • Planes de suscripción. El plan Pro no publica su límite en tokens. Depende de la longitud de los mensajes (adjuntos incluidos), de la conversación en curso y del modelo o función; se renueva cada cinco horas y tiene además un tope semanal.5 La ayuda de Anthropic añade como factores el uso de herramientas, el nivel de esfuerzo y las tareas de varios pasos.6

Cómo lo uso

Dos scripts de mi configuración global de Claude Code miden los tokens de cada sesión:

  • Línea de estado (context-bar.sh). Muestra modelo, carpeta, rama de git y una barra de diez tramos con el porcentaje de ventana ocupado. Suma los tokens de entrada, de lectura de caché y de escritura en caché del último mensaje del transcript, y toma el tamaño de ventana que le pasa Claude Code. Al empezar, estima unos 20K tokens de base (prompt de sistema, herramientas y memoria).
  • Hook de aviso (aviso-tokens.sh, en el evento UserPromptSubmit). Hace la misma suma y avisa una sola vez por sesión al 60 % y al 80 %. Al 80 % pide escribir un handoff.md y seguir en una sesión nueva con /clear. Cómo se monta, en hooks de Claude Code.
  • A mi entender, hay un desajuste: el hook asume una ventana de 200K salvo que se defina la variable CLAUDE_CONTEXT_WINDOW, y no está definida. Con modelos de 1M avisa hacia los 120K tokens, cuando la barra marca un 12 %. Es conservador y encaja con la degradación por contexto largo, pero conviene saberlo para no leer los dos indicadores como contradictorios.

Véase también

Referencias

Footnotes

  1. Glossary. Anthropic, documentación de la API. Consultado el 2026-10-09. ↩ ↩2 ↩3 ↩4 ↩5 ↩6

  2. Models overview. Anthropic, documentación de la API. Consultado el 2026-10-09. ↩ ↩2 ↩3 ↩4 ↩5 ↩6

  3. Token counting. Anthropic, documentación de la API. Consultado el 2026-10-09. ↩ ↩2 ↩3 ↩4 ↩5

  4. Pricing. Anthropic, documentación de la API. Consultado el 2026-10-09. ↩ ↩2 ↩3 ↩4 ↩5 ↩6

  5. What is the Pro plan?. Anthropic, centro de ayuda de Claude. Consultado el 2026-10-09. ↩

  6. Usage limit best practices. Anthropic, centro de ayuda de Claude. Consultado el 2026-10-09. ↩