Inicio / Qué es un modelo de lenguaje, sin jerga
El token y la ventana, lo que el modelo ve realmente
El modelo ve tokens apilados en una ventana con un techo fijo, no palabras enteras tomadas una por una, y una conversación que se acerca a ese techo cambia de contenido incluso antes de alcanzar su coste máximo, ya que Claude entonces resume los intercambios más antiguos.
Claude no lee palabras: lee tokens, pequeños fragmentos de texto, a veces una palabra entera, a veces una parte de palabra o un signo de puntuación. Es en tokens como se mide todo lo que puede ver en un instante dado, la pregunta planteada, los intercambios anteriores de la misma conversación, y los documentos pegados o adjuntos. Este conjunto cabe en una ventana cuyo tamaño es fijo, no en una memoria que se extendería a lo largo del intercambio.
Lo que la ventana contiene realmente
En los planes de pago, esta ventana alcanza un millón de tokens para los modelos Claude Fable 5, Claude Opus 5 y Claude Sonnet 5, y doscientos mil tokens fuera de estos tres modelos, según el centro de ayuda oficial consultado el 2 de septiembre de 2026, una cifra que la figura de esta lección cita con su fuente. Una parte de esta ventana siempre queda reservada a la respuesta de Claude, según ese mismo centro de ayuda, por lo que la conversación más larga posible es un poco más corta que la ventana entera. La interfaz de conversación no muestra esta cifra mientras escribes.
Lo que ocurre cuando la ventana se acerca a su techo
La consecuencia práctica se resume en una regla publicada por el centro de ayuda de Claude: cuando una conversación se acerca al límite de su ventana de contexto, Claude resume los mensajes más antiguos para hacer sitio, y ese resumen no cuenta dentro del límite de uso de la cuenta. La conversación cambia entonces de contenido incluso antes de alcanzar su techo: los primerísimos intercambios dejan de leerse palabra por palabra, se sustituyen por una versión condensada. Una instrucción planteada muy pronto en una conversación larga puede así acabar resumida en lugar de leída tal cual.
Estimar sin contador visible
A falta de un contador integrado en la pantalla de conversación, una regla general publicada por Anthropic permite estimar un volumen de tokens a partir del número de caracteres de un texto. La figura de esta lección da esta cifra y los dos tamaños de ventana.
Texto pegado: unos 800 caracteres, medidos con el contador de palabras del procesador de texto
Estimación: 800 dividido entre la cifra indicada en la figura, es decir unos 200 tokens
Ten esta estimación en mente antes de pegar un documento largo al principio de una conversación. Este es el gesto que propone esta lección, y prepara la lección sobre el orden de la información en un prompt largo, donde la posición de una frase cuenta tanto como su volumen.
El apilamiento que llena la ventana de contexto
Dos tamaños de ventana, y la regla para estimar un texto
Una asociación pega en una misma conversación un acta de doce páginas, y después los intercambios de las tres semanas anteriores, antes de plantear su pregunta. Claude responde resumiendo primero los mensajes más antiguos de la conversación antes de tratar la pregunta planteada.
Escribe en una frase lo que esta situación establece, y en una frase lo que no establece.
Lo que esto establece: La conversación se acercaba al límite de su ventana de contexto en el momento de esta respuesta, ya que este resumen automático de los mensajes antiguos se activa al acercarse al techo.
Lo que esto no establece: Que el acta de doce páginas se haya truncado o perdido, algo que una relectura del documento pegado permitiría confirmar.
Los tres calibrados falsos más frecuentes
- Demasiado amplio Claude ha alcanzado su límite absoluto y ya no puede responder a ninguna pregunta mientras no se borre la conversación.
- Demasiado estrecho Este resumen no dice nada sobre el estado de la ventana de contexto, se trata de una simple elección de estilo de respuesta.
- Fuera de lugar Esta situación muestra que pegar un acta de doce páginas al principio del mensaje es una buena práctica que conviene repetir sistemáticamente.
- Claude no lee palabras enteras sino tokens, fragmentos que pueden partir una palabra en varios trozos.
- El tamaño de la ventana de contexto depende del modelo elegido, no es idéntico para todos los modelos Claude disponibles en un plan de pago.
- Cuando una conversación se acerca al techo de su ventana, Claude resume los mensajes más antiguos, que entonces dejan de leerse palabra por palabra.
- La estimación del número de tokens de un texto se hace a partir de su número de caracteres, una regla general a falta de una visualización directa mientras se redacta el mensaje.
Retoma un texto largo que ya hayas enviado a Claude, cuenta o estima su número de caracteres con la herramienta de recuento de tu procesador de texto, y divide ese total entre la cifra indicada en la figura de esta lección para estimar cuántos tokens ocupa.
Estos puntos dependen de una interfaz o de una regla que puede haber cambiado desde la redacción. Verifícalos en tu propia pantalla antes de fiarte de ellos.
- Comprueba en tu propia interfaz de Claude si ahora aparece un contador de tokens o un indicador de llenado cerca del campo de escritura, esta visualización puede cambiar según el plan y las actualizaciones del producto.
Cada afirmación datable de esta lección remite aquí al texto público que la respalda. Una fuente que no se abre no prueba nada.
- Anthropic, tamaño de la ventana de contexto según el modelo y el plan consultée le 2026-09-02
- ¿Cómo funcionan los límites de uso y de longitud? consultée le 2026-09-02
- Precios (regla general sobre los tokens) consultée le 2026-09-02