logo santa marta crea
© 2016–2026 santa marta crea | N.I.T. 700173312-4

formación gratuita · módulo 05

Tokens y memoria

La IA no lee letras ni palabras: lee tokens. Y su memoria de trabajo — la ventana de contexto — tiene un límite. Cuando entiendas estas dos ideas, la mitad de los comportamientos "raros" de la IA dejarán de ser un misterio.

la ia no lee como tú

Tu texto, hecho pedacitos

Resumen

Un token es la unidad mínima de texto que procesa una inteligencia artificial: puede ser una palabra corta, un pedazo de una palabra larga, un signo de puntuación o un espacio. En español, un token equivale más o menos a tres o cuatro caracteres. Todo lo que le escribes a un chat de IA — y todo lo que él te responde — se mide en tokens: de ahí salen los límites de uso, la velocidad y el precio de estas herramientas. La ventana de contexto es la cantidad máxima de tokens que el modelo puede "ver" a la vez en una conversación; según el modelo, va desde unos 128.000 hasta alrededor de un millón. Cuando un chat se alarga demasiado, los mensajes más antiguos quedan fuera de esa ventana y la IA literalmente deja de verlos: por eso "olvida" lo que le dijiste al principio.

Tú lees palabras. La IA no: antes de procesar tu mensaje, lo parte en trocitos llamados tokens. Es su forma de convertir el lenguaje en números — que es lo único que una máquina sabe manejar de verdad.

01

¿Letras? No

Serían demasiados pedazos: procesar "inteligencia" letra a letra es lento y no aporta significado.

02

¿Palabras? Tampoco

Hay millones de palabras, inventos nuevos y errores de tecleo. Un diccionario cerrado se queda corto enseguida.

03

Tokens: el punto medio

Trozos frecuentes de texto: "casa" entra entero, "electrodoméstico" se parte en varios. Eficiente y flexible.

pruébalo tú · tokenizador visual

0 tokens   0 palabras   0 caracteres

Esta demo es una aproximación didáctica: cada modelo de IA trocea el texto a su manera (ChatGPT, Gemini y Claude usan tokenizadores distintos). La idea es la misma: fíjate cómo las palabras largas se parten y los signos cuentan aparte.

por qué importa

Los tokens son la moneda de la IA

Todo lo que entra y sale de una IA se cuenta en tokens. Por eso este concepto, que parece técnico, decide cosas muy prácticas de tu día a día con estas herramientas.

01 · precio

Se cobra por token

Los planes y las tarifas de las IA se calculan por tokens procesados. Un texto el doble de largo cuesta el doble de procesar — aunque diga lo mismo.

02 · velocidad

Se genera token a token

Cuando ves la respuesta "escribirse" en pantalla, es literal: el modelo produce un token cada vez, uno detrás de otro.

03 · límites

Se limita por tokens

El "no me cabe este documento" de un chat de IA es un límite de tokens, no de páginas ni de megas. Ahora vas a ver cuánto cabe de verdad.

pruébalo tú · ¿cuánto le cabe a una ia?

Elige un documento y una IA, y mira si cabe en su ventana de contexto.

el documento

la ventana de la IA

Elige arriba un documento y una ventana.

Cifras orientativas para que veas los órdenes de magnitud: los tamaños reales varían según el documento y el modelo. Las ventanas actuales van desde unos 128.000 tokens en los chats más comunes hasta alrededor de 1.000.000 en modelos como Gemini.

la memoria del chat

La ventana que olvida

La ventana de contexto es todo lo que la IA puede "ver" en un momento dado: tu conversación entera tiene que caber ahí. Cuando se llena, los mensajes más antiguos se caen — y la IA sigue respondiendo como si nada, pero ya no los ve. Compruébalo tú:

pruébalo tú · una conversación que se alarga

Esta IA de juguete solo puede ver 6 mensajes a la vez. Ve alargando la conversación y, cuando quieras, pregúntale por el color del logo — que se menciona al principio.

Los mensajes que se salen del recuadro teal quedan fuera de la ventana: la IA ya no los ve.

primeras victorias

Trucos que puedes usar hoy

Con lo que acabas de aprender, estos cuatro hábitos te van a mejorar cualquier chat de IA desde ya:

01

Un chat por tema

No uses una sola conversación eterna para todo. Chat nuevo, tema nuevo: la ventana llega más lejos y la IA no mezcla asuntos.

02

Si el chat es largo, repite lo clave

¿Llevas horas en la misma conversación? No des por hecho que la IA recuerda el principio. Repite el dato importante en tu último mensaje.

03

Pega solo lo necesario

Antes de pegar un documento de 40 páginas, pregúntate qué parte necesita la IA de verdad. Menos relleno = mejores respuestas y menos tokens gastados.

04

Cierra con resumen, abre con resumen

Si una conversación valiosa se está alargando, pídele a la IA: "resume todo lo acordado hasta ahora". Copia ese resumen y arranca un chat nuevo con él. Memoria fresca, sin perder nada.

ponte a prueba

Quiz del módulo

5 preguntas sobre lo que acabas de ver. Con 4 aciertos completas el módulo. Puedes repetirlo las veces que quieras.