Tokens, contexto y memoria: la mesa de trabajo de la IA
Hay tres palabras que vas a escuchar seguido y que conviene entender sin miedo: tokens, ventana de contexto y memoria. Las tres explican por qué a veces la IA «se olvida» de algo que le dijiste al inicio de la plática.
Tres conceptos clave
Es el pedacito de texto con el que trabaja el modelo. Puede ser una palabra corta o parte de una palabra larga. «Aguacate» podría dividirse en «agua» y «cate». Como regla práctica, 100 palabras en español son unos 130-150 tokens.
Es todo lo que el modelo puede «tener a la vista» al mismo tiempo: tus mensajes, sus respuestas y los documentos que subiste. Si se llena, lo más antiguo se pierde o se resume.
Algunas apps (como ChatGPT o Claude) pueden guardar datos tuyos entre conversaciones, por ejemplo tu nombre o tus preferencias. Puedes revisarla y borrarla en la configuración.
Imagina que la IA trabaja sobre un escritorio. Todo lo que está encima (tu conversación, tus archivos) lo puede ver y usar. El escritorio es grande, pero no infinito: cuando se llena, los papeles más viejos se caen al piso.
Y cada vez que abres un chat nuevo, es como darle un escritorio vacío: no ve lo que hablaron en otra conversación, salvo lo que guarde la función de memoria.
✅ Consejos prácticos que salen de aquí
¿Por qué importan los tokens si no pago por ellos?
En las versiones gratuitas no ves los tokens, pero sí sus efectos: hay un límite de mensajes por día o por cierto número de horas, y los documentos muy largos pueden no caber completos. En las versiones de pago, y sobre todo cuando las empresas conectan la IA a sus sistemas, los tokens son literalmente la unidad con la que se cobra. Es como la luz: se mide en kilowatts, aquí se mide en tokens.
Haz este experimento en dos partes para ver la ventana de contexto en acción.
Me llamo Carmen, vivo en Mérida y tengo una fonda. Recuerda estos datos. Ahora dame tres ideas para promocionar mi menú del día en WhatsApp.
Ideas pensadas para una fonda en Mérida. Luego, si en el mismo chat preguntas «¿Cómo me llamo y dónde vivo?», lo recordará.
Abre un chat nuevo y pregunta «¿Cómo me llamo?». Observa qué pasa: si no lo sabe, es el escritorio vacío; si lo sabe, tiene activada la memoria entre chats.
- ›Los tokens son los pedacitos de texto con los que trabaja el modelo.
- ›La ventana de contexto es su escritorio: lo que puede ver a la vez.
- ›Un chat nuevo es un escritorio vacío; la memoria guarda algunos datos entre chats.
- ›Da el contexto importante en tu mensaje y abre chats nuevos al cambiar de tema.