# ¿Qué es un token en IA?

3 de octubre de 2026 · Thiago Perez

URL: https://aigrowth.com.ar/blog/que-es-un-token

Cuando te llega la boleta de la luz, ¿qué te cobran? Kilovatios hora, los famosos kWh. Con la inteligencia artificial pasa exactamente lo mismo, solo que la unidad tiene otro nombre: **se mide en tokens**.

Un kWh te dice cuánta electricidad consumiste. Un token te dice cuánto procesó la IA: lo que le escribís y lo que te responde.

Si usás ChatGPT con un abono mensual, probablemente nunca viste un token en tu factura. Pero apenas conectás la IA a tu WhatsApp, a tu web o a tus sistemas, por ejemplo con un agente que atiende consultas (acá explicamos [la diferencia entre un agente de IA y un chatbot](https://aigrowth.com.ar/blog/agente-ia-vs-chatbot)), el consumo se paga por token. Y entender cómo se mide te ayuda a saber cuánto vas a gastar.

## Qué es un token, en palabras simples

Un token es un **pedacito de texto**: la unidad con la que los [modelos de IA](https://aigrowth.com.ar/blog/que-es-un-llm) leen y escriben. Según OpenAI, un token puede ser un carácter, una parte de una palabra, una palabra entera o un signo de puntuación.

Antes de procesar tu mensaje, la IA lo corta en tokens. Por ejemplo, con el tokenizador público de OpenAI para GPT-4o, la frase "Hola, ¿tienen turnos para el sábado?" queda dividida en 11 tokens:

> Hola · , · ¿ · t · ienen · turn · os · para · el · sábado · ?

Las palabras comunes suelen ser un solo token ("Hola", "sábado"). Las menos frecuentes se parten en varios: "inteligencia" son tres tokens. Y no todo es texto: las imágenes y los audios también se convierten en tokens. En los modelos de Google, por ejemplo, cada segundo de audio cuenta como 32 tokens.

_Animación interactiva: en la página, cada frase se corta en tokens de colores y un medidor, como el de la luz, suma uno por cada token. También podés escribir tu propio texto y ver una estimación. Estos son los ejemplos:_

- "Hola, ¿tienen turnos para el sábado?" (consulta de turnos): 6 palabras, **11 tokens**. Hola · , · ¿ · t · ienen · turn · os · para · el · sábado · ?
- "Cuando te llega la boleta de la luz, te cobran kWh." (la boleta de la luz): 11 palabras, **15 tokens**. Cuando · te · llega · la · bo · leta · de · la · luz · , · te · cobran · k · Wh · .
- "¿Hacen envíos al interior? Necesito tres cajas para el viernes." (pedido con envío): 10 palabras, **16 tokens**. ¿ · H · acen · env · íos · al · interior · ? · Neces · ito · tres · cajas · para · el · viernes · .
- "Hi, do you have appointments on Saturday?" (la misma consulta en inglés): 7 palabras, **9 tokens**. Hi · , · do · you · have · appointments · on · Saturday · ?

Ejemplos medidos con o200k_base (tiktoken 0.14.0), el tokenizador de OpenAI para GPT-4o y GPT-5. Otros modelos cortan distinto. Con tu texto, el número es una estimación: unos 1,3 tokens por palabra, según nuestra medición en español.

## ¿Cuántas palabras es un token? En español, un poco más

OpenAI y Anthropic usan la misma regla aproximada para el inglés: **un token equivale a unos 4 caracteres, o a tres cuartos de una palabra**. Dicho de otra forma, 100 tokens son unas 75 palabras. Google da un rango parecido: 100 tokens son entre 60 y 80 palabras en inglés.

Las tres empresas aclaran que esto cambia según el idioma. Para ver cómo se comporta el español, contamos los tokens de cinco mensajes típicos de atención al cliente y de su traducción al inglés:

| Texto | Palabras | Tokens | Tokens por palabra |
| --- | --- | --- | --- |
| 5 mensajes de atención al cliente en español | 112 | 142 | 1,3 aprox. |
| Los mismos 5 mensajes en inglés | 122 | 137 | 1,1 aprox. |

La medición es nuestra, hecha el 3 de octubre de 2026 con o200k_base, el tokenizador que OpenAI publica para GPT-4o y GPT-5. El español usó algo más de tokens por palabra, aunque en total la diferencia fue chica. Como regla práctica, **en español calculá un poco más de un token por palabra**: con esta muestra, 1.000 palabras serían unos 1.300 tokens.

Es una aproximación, no una regla fija: cada modelo corta el texto a su manera. Anthropic, por ejemplo, avisa que sus modelos desde Claude 4.7 usan un tokenizador nuevo que genera alrededor de un 30% más de tokens para el mismo texto.

## Lo que le escribís y lo que te responde: tokens de entrada y de salida

En la boleta de la luz pagás un solo precio por kWh. Con la IA hay **dos precios**: uno por lo que el modelo lee y otro por lo que escribe.

- **Tokens de entrada:** todo lo que le mandás al modelo. Tu pregunta, pero también las instrucciones, la información de tu negocio, los documentos y el historial de la conversación.
- **Tokens de salida:** todo lo que el modelo genera, es decir, la respuesta. En los modelos que "razonan" antes de contestar, ese razonamiento interno también se cobra como salida, aunque no lo veas.

La salida es más cara. En las tablas de precios que consultamos, un token de salida cuesta cinco veces más que uno de entrada. Para la IA, escribir sale más caro que leer.

## La ventana de contexto: la memoria de trabajo de la IA

La **ventana de contexto** es todo lo que el modelo puede tener en cuenta al responder, incluida la respuesta que está generando. Anthropic la describe como la "memoria de trabajo" del modelo, y no hay que confundirla con todo lo que aprendió cuando lo entrenaron.

Se mide en tokens, y cada modelo tiene su límite. Los modelos más recientes de Claude, por ejemplo, tienen una ventana de 1 millón de tokens.

Acá aparece algo importante para tu bolsillo: en una conversación, **cada mensaje nuevo vuelve a enviar todo el historial como entrada**. El mensaje número 10 incluye los nueve anteriores. Por eso una conversación larga cuesta más que la suma de sus preguntas sueltas.

Y más contexto no siempre es mejor. Anthropic advierte que, a medida que crece la cantidad de tokens, el modelo puede perder precisión. Conviene darle lo que necesita, no todo lo que tenés.

## Por qué te cobran por token, como la luz

A la empresa que provee el modelo, cada token le cuesta procesarlo. Por eso cobra por consumo, igual que la distribuidora cobra por kWh. Google lo dice directamente: el costo de usar su API depende en parte de la cantidad de tokens de entrada y de salida.

Como un token es muy poco, los precios se publican **por millón de tokens**. Estos son algunos valores de referencia:

| Modelo | Entrada (por millón) | Salida (por millón) | Fuente |
| --- | --- | --- | --- |
| gpt-6-luna | US$ 0,10 | US$ 0,50 | OpenAI |
| Claude Haiku 4.5 | US$ 1 | US$ 5 | Anthropic |
| gpt-6.1-sol | US$ 2 | US$ 10 | OpenAI |
| Claude Sonnet 5.5 | US$ 2 | US$ 10 | Anthropic |

Son precios estándar, sin descuentos por caché ni por procesamiento en lote. En el caso de OpenAI, corresponden a contexto corto. Y como pasa con la tarifa de la luz, pueden cambiar: antes de hacer cuentas, revisá la página oficial de precios.

## Un ejemplo de costo, paso a paso

Imaginá un negocio con un agente de IA que responde **1.000 consultas por mes**. Para el ejemplo suponemos que cada consulta usa 10.000 tokens de entrada (instrucciones, información del negocio e historial) y 500 tokens de salida. Son números inventados para hacer la cuenta, no una medición.

- **Entrada:** 1.000 consultas × 10.000 tokens = 10 millones de tokens. Con gpt-6.1-sol, a US$ 2 por millón: **US$ 20**.
- **Salida:** 1.000 consultas × 500 tokens = medio millón de tokens. A US$ 10 por millón: **US$ 5**.
- **Total con gpt-6.1-sol:** US$ 25 por mes.
- **El mismo uso con gpt-6-luna** (US$ 0,10 de entrada y US$ 0,50 de salida por millón): US$ 1 + US$ 0,25 = **US$ 1,25 por mes**.

El mismo volumen puede costar 20 veces más o menos según el modelo. Pero ojo: OpenAI aclara que un precio por token más bajo no garantiza un costo total más bajo, porque cada modelo corta el texto distinto y puede generar respuestas más largas. Lo recomendable es probar con tareas reales.

El otro gran factor es cuántos tokens usa cada consulta, y eso depende de cómo esté armado el agente. Las propias empresas publican estimaciones muy distintas: Anthropic usa unos 3.700 tokens por conversación en un ejemplo de soporte, y Meta calcula que cada mensaje de su agente para WhatsApp consume entre 20.000 y 25.000 tokens, a US$ 2 por millón (unos 4 a 5 centavos de dólar por mensaje). El número que importa es el tuyo, medido con tus consultas reales.

Si el agente responde por WhatsApp, a los tokens hay que sumarles lo que cobra WhatsApp por los mensajes. En [esta nota explicamos cómo calcular el costo de WhatsApp](https://aigrowth.com.ar/blog/costos-whatsapp).

## Cómo gastar menos tokens sin que la IA ande peor

- **Elegí el modelo según la tarea.** Para consultas simples, un modelo chico suele alcanzar. Anthropic recomienda reservar los modelos más potentes para el razonamiento complejo.
- **Escribí instrucciones claras y sin relleno.** Sacá lo repetido y lo que el modelo no usa: todo eso se paga en cada consulta.
- **Mandale lo que necesita, no todo.** Resumí documentos largos o historiales extensos antes de enviarlos, y dividí lo grande en partes.
- **Limitá el largo de las respuestas.** La salida es la parte más cara, y se puede fijar un máximo de tokens por respuesta.
- **Aprovechá el caché.** Lo que se repite en cada consulta, como las instrucciones o la información del negocio, se puede guardar en caché. En Anthropic, leer desde caché cuesta un 10% del precio normal de entrada.
- **Lo que no es urgente, mandalo en lote.** Anthropic y OpenAI cobran la mitad por el procesamiento en lote, que entrega los resultados más tarde.
- **Medí.** Cada respuesta informa cuántos tokens de entrada y de salida usó. Revisá ese consumo como revisarías la boleta.

## Preguntas frecuentes

### ¿Un token es lo mismo que una palabra?

No. Una palabra puede ser un token o varios, y los signos de puntuación también cuentan. En español, calculá un poco más de un token por palabra.

### ¿Pago tokens si uso ChatGPT con suscripción?

Con un abono mensual pagás una tarifa fija y no ves tokens en la factura. El cobro por token aparece cuando usás los modelos a través de su API, que es lo que se usa para conectar la IA a WhatsApp, a tu web o a tus sistemas.

### ¿Escribir en español sale más caro?

Un poco. En nuestra prueba, el español usó más tokens por palabra que el inglés, pero el total fue parecido: 142 tokens contra 137 para los mismos mensajes. Pesa mucho más el modelo que elijas y cuánto contexto le mandes.

### ¿Qué pasa si se llena la ventana de contexto?

Depende de la herramienta. Por API, si lo que mandás supera el límite, el pedido se rechaza. Las aplicaciones de chat pueden ir descartando los mensajes más viejos, y por eso a veces una conversación muy larga "se olvida" de lo que dijiste al principio.

### ¿Las imágenes y los audios también gastan tokens?

Sí. En los modelos de Google, una imagen chica cuenta como 258 tokens y cada segundo de audio, como 32 tokens.

Si querés saber cuánto te costaría usar IA en tu negocio, podemos estimarlo juntos a partir de tus consultas reales. Podés conocer cómo trabajamos los [agentes de IA](https://aigrowth.com.ar/servicios/agentes-ia) o, directamente, [agendar una llamada para revisar tu caso](https://cal.com/thiago-perez-d7wajx/30min).

## Fuentes

- [OpenAI: qué son los tokens y cómo contarlos](https://help.openai.com/en/articles/4936856-what-are-tokens-and-how-to-count-them): definición, equivalencias en inglés, tokens de entrada, salida, caché y razonamiento, y consejos para reducir la entrada (consultado el 3/10/2026).
- [Anthropic: precios de Claude](https://docs.anthropic.com/en/docs/about-claude/pricing): precios por millón de tokens, caché a 0,1x, descuento del 50% en lote, tokenizador de Claude 4.7 y ejemplo de 3.700 tokens por conversación (consultado el 3/10/2026).
- [Anthropic: ventanas de contexto](https://docs.anthropic.com/en/docs/build-with-claude/context-windows): memoria de trabajo, historial reenviado en cada turno, ventana de 1 millón de tokens y pérdida de precisión con contextos largos (consultado el 3/10/2026).
- [OpenAI: precios de la API](https://platform.openai.com/docs/pricing): precios por millón de tokens de gpt-6.1-sol y gpt-6-luna, procesamiento estándar y en lote (consultado el 3/10/2026).
- [Google: entender y contar tokens en la API de Gemini](https://ai.google.dev/gemini-api/docs/tokens): equivalencias, tokens de imágenes y audio, y ventana de contexto (actualizado el 23/9/2026).
- [Meta: precios de WhatsApp Business Platform](https://developers.facebook.com/documentation/business-messaging/whatsapp/pricing): Meta Business Agent a US$ 2 por millón de tokens y 20.000 a 25.000 tokens por mensaje (actualizado el 30/9/2026).
- [tiktoken](https://github.com/openai/tiktoken), la biblioteca de OpenAI usada para nuestra medición en español e inglés (versión 0.14.0, codificación o200k_base).
