Miércoles, 22 de julio de 2026  ·  LATAM / Español
ÚLTIMA HORA
Anthropic lanza mejoras en la API de Claude para América Latina  ·  MCP 2026-07-28 ya en release candidate  ·  Claude Sonnet 5 supera benchmarks de coding agéntico  ·  Claude Code alcanza $1B de run-rate en 6 meses  ·  NSA publica guía de seguridad para el protocolo MCP
Hace 45 min →
Concepto

Token

Unidad mínima de texto que Claude procesa: fragmentos de palabras, caracteres o signos en que se descompone la entrada y la salida, y que sirven para medir el consumo y facturar la API.

También: token · tokens · tokenización · tokens en Claude

Un token es la unidad mínima con la que Claude lee y genera texto. Antes de procesar cualquier mensaje, el modelo descompone el texto en fragmentos (tokens) que pueden ser palabras completas, trozos de palabras, caracteres sueltos o signos de puntuación. Claude no ve letras ni palabras tal como las entendemos: opera sobre secuencias de tokens convertidos en números.

Cómo funciona la tokenización

El proceso se llama tokenización y lo realiza un componente llamado tokenizador. Este divide el texto según patrones estadísticos de subpalabras aprendidos sobre grandes corpus. Palabras frecuentes suelen ocupar un solo token, mientras que términos raros, nombres propios o palabras en idiomas menos representados se parten en varios.

Como regla práctica en inglés, un token equivale aproximadamente a 4 caracteres o unas 0,75 palabras. En español el ratio suele ser algo menos eficiente: una misma frase tiende a consumir más tokens que su equivalente en inglés, porque el vocabulario del tokenizador está más optimizado para el inglés. Los signos de puntuación, los espacios y los saltos de línea también cuentan como tokens.

Tanto lo que envías (input) como lo que Claude responde (output) se miden en tokens. La suma de ambos debe caber dentro de la ventana de contexto del modelo.

Por qué importa

Los tokens son la unidad de medida y de facturación de la API de Claude. Entender cómo se cuentan tiene tres consecuencias directas para quien construye:

Por eso conviene interiorizar el concepto desde el principio, algo que trabajamos en el curso para empezar con Claude desde cero antes de entrar en técnicas más avanzadas de prompting.

Ejemplo y cifras reales

La frase Hola, ¿cómo estás? se descompone en varios tokens: el signo de apertura, las palabras, la coma y los espacios cuentan por separado. Una página de texto (unas 500 palabras) ronda los 650 a 750 tokens en inglés y algo más en español.

Los modelos Claude actuales ofrecen ventanas de contexto amplias (200.000 tokens en la familia Claude 3 y posteriores, con opciones ampliadas para casos concretos). Eso equivale aproximadamente a un libro corto completo cabiendo en un solo prompt. Anthropic ofrece un endpoint de conteo de tokens para estimar el tamaño antes de enviar la petición.

Errores comunes

Preguntas frecuentes

¿Cuántos tokens es una palabra en español?

No hay una equivalencia fija. En inglés un token equivale a unas 0,75 palabras; en español el ratio es algo menor, así que una misma frase suele consumir más tokens que en inglés por cómo está optimizado el tokenizador.

¿Los tokens de entrada y de salida cuestan lo mismo?

No. La API de Claude factura por separado los tokens de input y de output, y el output suele tener un precio por token más alto. Por eso acotar la longitud de las respuestas reduce el coste.

¿Cómo puedo contar los tokens antes de enviar un prompt?

Anthropic ofrece un endpoint de conteo de tokens en su API que permite estimar el tamaño de un mensaje antes de enviarlo, útil para controlar coste y no superar la ventana de contexto.

¿Los espacios y signos de puntuación cuentan como tokens?

Sí. Espacios, saltos de línea, comas y demás signos se tokenizan y cuentan para el consumo total, aunque muchos ocupan un fragmento pequeño combinado con la palabra adyacente.

Términos relacionados

Fuentes