Ir al contenido
Mastering Claude

Inicio / Contexto y coste

Contexto y coste7 minApplication

El umbral de autocompactado no hace lo que se cree

El umbral de autocompactado activa un resumen de la conversación cuando el contexto lo alcanza, no es un muro que cierre la ventana: un valor configurado por encima de la ventana real del modelo activo queda limitado a esa ventana, un comportamiento documentado cuya ausencia de aviso en pantalla queda por verificar uno mismo.

El umbral de autocompactado no es un cierre que impida que el contexto supere un tamaño determinado. Es un punto de activación: cuando la conversación alcanza ese umbral, Claude Code lanza un resumen automático del historial. Nada en este mecanismo vuelve a cerrar la ventana en sí misma, y un valor de umbral configurado por encima de la ventana real del modelo activo no produce ningún error mostrado en pantalla: simplemente queda limitado a esa ventana.

El límite, sin garantía de aviso

La documentación oficial lo formula sin rodeos: el límite retenido sigue siendo siempre el del modelo, sea cual sea el valor de umbral configurado por otra parte. Fijar un umbral en un millón de tokens mientras el modelo activo solo dispone de una ventana de doscientos mil tokens no amplía nada, el cálculo vuelve a caer en los doscientos mil tokens reales. La documentación no dice explícitamente si este tope va acompañado o no de un aviso en pantalla, solo documenta el tope en sí mismo: verificarlo en tu propio equipo vale más que suponerlo silencioso. La creencia más extendida trata este umbral como un muro duro, cuando en realidad funciona como una señal de salida para un resumen, ella misma limitada por un límite que no controla.

Cuando el resumen se repite sobre sí mismo

Un segundo mecanismo complica el panorama. Después de una compactación, si el contexto vuelve a llenarse hasta el límite casi de inmediato, y este ciclo se repite varias veces seguidas, Claude Code deja de relanzar la compactación y muestra un error explícito en lugar de seguir en bucle.

Autocompact is thrashing: the context refilled to the limit...

Este inicio de mensaje, que la propia documentación cita antes de cortar con puntos suspensivos, señala una protección anti-thrashing, un dispositivo que reconoce que un resumen tras otro no resuelve nada mientras la fuente del llenado, un archivo grande releído en cada llamada de herramienta por ejemplo, siga en la conversación. La protección se detiene tras unos intentos y devuelve este error en lugar de seguir en bucle sin decirlo.

Lo que queda por retener

Dos consecuencias prácticas se derivan de estos dos mecanismos. Primero, un umbral personalizado más alto que la ventana del modelo no sirve de nada, hay que verificar la ventana real del modelo en curso antes de configurar cualquier cosa. Después, una sesión que muestra un error de thrashing señala un problema de contenido, no un defecto del software: el reflejo correcto es retirar lo que llena el contexto en lugar de relanzar la misma acción esperando un resultado distinto. La lección vecina sobre compactar, borrar, leer solo lo necesario detalla cómo elegir entre estos dos comandos una vez entendido este umbral.

Figure 1

El umbral frente a la ventana real del modelo

Lo que se cree

El umbral de autocompactado cierra la ventana de contexto en el valor configurado, como un tope duro que bloquearía cualquier exceso.

Lo que se mide

Un valor de umbral fijado por encima de la ventana real del modelo activo queda limitado a esa ventana, sin que la documentación precise si un mensaje acompaña este tope.

La columna de la izquierda muestra la expectativa intuitiva de un tope duro, la columna de la derecha muestra el comportamiento realmente documentado cuando el umbral supera la ventana del modelo activo.
Calíbralo tú mismo

Una asociación configura el umbral de autocompactado de su sesión de Claude Code en un valor claramente superior a la ventana real del modelo que utiliza ese día. Luego continúa una larga conversación de investigación documental durante varias horas.

Escribe en una frase lo que esta situación establece, y en una frase lo que no establece.

Lo que hay que recordar
  • El umbral de autocompactado funciona como un disparador de resumen, nunca como un cierre que impida que el contexto siga creciendo.
  • Un valor de umbral configurado por encima de la ventana real de un modelo queda limitado a esa ventana; si este tope va acompañado o no de un mensaje en pantalla queda por verificar uno mismo, la documentación no lo precisa.
  • Una protección anti-thrashing detiene los intentos de compactación repetida cuando el contexto vuelve a llenarse justo después de cada resumen, y muestra un error en lugar de seguir en bucle.
  • La ventana real del modelo activo sigue siendo el único límite que cuenta, un ajuste personalizado nunca puede ampliarla.
Hazlo ahora

Abre una sesión activa de Claude Code, escribe /model para leer la ventana real mostrada para el modelo en curso, luego escribe /context para ver la parte de esa ventana ya utilizada. Anota las dos cifras: es esa ventana real, nunca un umbral personalizado más alto, la que fija el límite verdadero de tu sesión.

Lo que queda por verificar

Estos puntos dependen de una interfaz o de una regla que puede haber cambiado desde la redacción. Verifícalos en tu propia pantalla antes de fiarte de ellos.

  • El valor por defecto del umbral de autocompactado que muestra tu propia instalación de Claude Code: puede variar según el modelo y la versión instalada, hay que leerlo directamente vía /context en lugar de fiarse de una cifra anunciada aquí.
Verificar en la fuente

Cada afirmación datable de esta lección remite aquí al texto público que la respalda. Una fuente que no se abre no prueba nada.