Gestionar la ventana de contexto
Administra la ventana de contexto de Bob para preservar la memoria, controlar el costo y mantener la calidad de salida.
Cada tarea (conversación) en el panel de chat tiene una ventana de contexto. La ventana de contexto es el límite de tokens de lo que Bob puede mantener en memoria en la sesión actual. El contexto incluye instrucciones del sistema, esquemas de herramientas, tus reglas y skills, y la transcripción completa.
En este tutorial, abrirás la ventana de contexto, aprenderás qué carga Bob antes de que hagas trabajo real y aprenderás cuándo crear una nueva ventana de contexto.
Al final de este tutorial, aprenderás lo siguiente:
- Identificar cada categoría de la ventana de contexto y qué carga Bob en ella.
- Medir la sobrecarga base del contexto en Galaxium Travels.
- Ver cómo Messages crece después de un prompt sobre el repositorio mientras las categorías fijas se mantienen estables.
- Iniciar una nueva tarea para restablecer la ventana de contexto mientras mantienes la tarea anterior en el historial.
Cómo se organiza este tutorial
| Paso | Sección | Lo que haces |
|---|---|---|
| 1 | Preparar el laboratorio | Abrir Galaxium Travels y el panel de chat |
| 2 | Leer el desglose de la ventana de contexto | Enviar un prompt mínimo y luego revisar un desglose nuevo (~8.5k) |
| 3 | Hacer crecer Messages con un prompt | Listar archivos y luego verificar que Messages sube a ~4.2k (12.1k en total) |
| 4 | Crear una nueva ventana de contexto | Hacer clic en + (Nueva tarea) y luego verificar que el indicador se restablece |
Familiarízate con los siguientes términos:
- Tarea: Un hilo de conversación con su propia ventana de contexto. Inicias una nueva ventana de contexto con + (Nueva tarea). Aquí viven tus prompts, las respuestas de Bob y los botones de aprobación.
- Desglose de la ventana de contexto: Haz clic en el indicador de uso de tokens en la parte superior derecha del panel de chat para ver a dónde van los tokens.
Los totales varían según los servidores MCP, las reglas, los skills y cuánto lea Bob. Las siguientes cifras son de Galaxium Travels en una ventana de 270.0k. Las categorías fijas deberían estar cerca de estos números. Messages depende de lo que le pidas a Bob que haga.
Requisitos previos
Para completar este tutorial, necesitas lo siguiente:
IBM Bob IDE
Descarga e instala IBM Bob v2.x o posterior.
Git
Git es necesario para clonar el repositorio de ejemplo.
Por qué importa la gestión del contexto
Costo de tokens
Los tokens son la unidad de consumo de Bob, medida en Bob coins. Las conversaciones más largas y las lecturas de archivos más grandes consumen más tokens. Mantener conversaciones enfocadas reduce el costo.
Cada prompt vuelve a enviar todo el contexto activo. Eso incluye sobrecarga fija que tú nunca escribiste. Incluso una pregunta de una sola línea sigue incluyendo definiciones de herramientas, reglas y cualquier otra cosa que Bob cargue por defecto.
El resumen pierde información
Cuando Bob alcanza su límite de tokens, Bob condensa contenido anterior para poder seguir trabajando, lo que hace que se pierdan detalles. Puedes perder casos límite, razonamiento intermedio y restricciones que mencionaste muchos prompts antes.
Si todavía necesitas los detalles del contenido, inicia una nueva tarea antes de que Bob los resuma y los haga desaparecer.
La calidad se degrada antes del límite
Actualmente Bob usa una ventana de 270.0k tokens. Revisa tu propio indicador de uso de tokens para ver el límite exacto. La calidad suele bajar antes de que llegues a él. A medida que Messages crece, las respuestas se vuelven menos fiables.
Preparar el laboratorio
-
Clona el repositorio de Galaxium Travels.
git clone -b bob-learning-path-branch https://github.com/IBM/galaxium-travels -
Haz clic en File y luego en Open Folder.
-
Ve al directorio
galaxium-travelsque clonaste y ábrelo. -
Abre la interfaz de chat de Bob haciendo clic en el icono de Bob junto a la barra de navegación, o usa el atajo Option + Command + B (macOS) o Ctrl + Alt + B (Windows).
-
En el campo de entrada del chat, ejecuta
/init. Bob analiza el repositorio y crea un archivoAGENTS.mdcon reglas del proyecto. Haz clic en Approve todo tools for task si se te solicita.Espera a que Bob informe que terminó. Este
AGENTS.mdes lo que luego aparece como la línea Rules en el desglose de la ventana de contexto, así que el repositorio lo necesita antes de que midas una línea base.
Leer el desglose de la ventana de contexto
Obtén una línea base nueva y luego lee el desglose.
-
Haz clic en + en la parte superior del panel de chat para iniciar una nueva tarea.
-
Envía un prompt mínimo para usar una pequeña cantidad de tokens:
Devuélveme un hola rápido.Espera la respuesta de Bob.
-
Haz clic en el indicador de uso de tokens en la parte superior derecha del panel de chat para ver el desglose.

Después de este intercambio en Galaxium Travels, tus números variarán, pero verás cifras cercanas a estas:
| Tokens | |
|---|---|
| Total used | 8.5k (~3% lleno) |
| System prompt | 1.5k |
| Tool definitions | 5.1k |
| Rules | 830 |
| Skills | 454 |
| Messages | 590 |
| Reserved for model response | 20.0k |
| Available space | 241.5k |
Si Total used está muy lejos de 8.5k, comprueba que iniciaste una tarea nueva y enviaste solo ese prompt.
Tool definitions suele ser la categoría fija más grande. Los servidores MCP y los esquemas de herramientas integradas se cargan aunque no los uses. Rules viene de archivos del proyecto como AGENTS.md. Skills puede aumentar más tarde si Bob carga un skill durante la tarea.
-
Lee cada categoría. El desglose muestra a dónde van los tokens:
Categoría Qué es System prompt Las instrucciones principales de Bob para esta sesión Tool definitions Esquemas de las herramientas integradas de Bob y de las herramientas MCP conectadas Rules Instrucciones personalizadas de tu proyecto y modo (custom rules, por ejemplo AGENTS.md)Skills Instrucciones de cualquier skill que Bob haya cargado (la UI puede mostrar un recuento, por ejemplo Skills (1 loaded)) Messages Tus prompts, las respuestas de Bob y la actividad de herramientas en la tarea. Esta es la transcripción contada como tokens. En Estimated breakdown:
- Reserved for model response: Tokens reservados para que Bob pueda responder sin llegar inmediatamente al límite.
- Available space: Tokens estimados que siguen libres antes de que Bob necesite condensar contenido.
En Galaxium, las categorías fijas (System prompt, Tool definitions, Rules, Skills) suman aproximadamente 8k antes de hacer trabajo real. Pagas eso en cada turno, aunque tú no lo hayas escrito.
Hacer crecer Messages con un prompt
Quédate en la misma tarea. Envía un prompt que haga crecer la transcripción.
-
Pide una lista de archivos.
Enumera todos los archivos de este directorio.Aprueba las acciones de lectura si se te solicita. Bob enumera los archivos del repositorio.
-
Compara qué cambió. Abre el desglose otra vez. En Galaxium Travels, deberías ver números cercanos a estos:
Categoría Tarea nueva Después de list-files Trabajo sostenido (referencia) System prompt 1.5k 1.5k 1.5k Tool definitions 5.1k 5.1k 5.1k Rules 830 830 830 Skills 454 454 1.2k (1 cargado) Messages 590 4.2k 19.4k Total used 8.5k (~3%) 12.1k (~4%) 28.0k (~10%) Available space 241.5k 237.9k 222.0k Messages ahora debería mostrar alrededor de 4.2k. Si es mucho más alto, Bob leyó más archivos que en este ejemplo, lo cual está bien. El punto es que Messages creció mientras las categorías fijas no cambiaron.
La salida de la lista y la actividad de herramientas quedan en la transcripción. System prompt, Tool definitions, Rules y Skills se mantienen estables después de un solo prompt de list-files.
La columna de la derecha viene de una sesión más larga de Galaxium con más lecturas y prompts de seguimiento. Skills puede aumentar si Bob carga un skill (de 454 a 1.2k en ese ejemplo). Con el tiempo, Messages suele ser lo que más rápido crece.
Un solo prompt de list-files añade alrededor de 3.6k a Messages en Galaxium. La sobrecarga fija se mantiene cerca de 8k. Explorar el repositorio consume contexto rápidamente incluso cuando la sobrecarga no cambia.
Crear una nueva ventana de contexto
Inicia una nueva tarea en el mismo proyecto. La tarea anterior (conversación) se queda en el historial.
-
Haz clic en + (Nueva tarea) en la parte superior del panel de chat.
El indicador se restablece. Messages vuelve a un número pequeño. System prompt, Tool definitions, Rules y Skills se vuelven a cargar aproximadamente al valor base.
-
La tarea que dejaste sigue en la lista de tareas y puedes volver a ella en cualquier momento. Mantiene su propia transcripción y su propio conteo de tokens. Bob no la usa mientras trabajas en la nueva tarea.
Inicia una nueva tarea cuando:
- cambies de tema o de objetivo de trabajo.
- Messages sea lo bastante grande como para afectar la calidad o el costo. En Galaxium, 19.4k en Messages es una señal razonable para restablecer.
- hayas terminado la planificación y quieras una tarea limpia para la implementación. Consulta Planificar e implementar funciones complejas.
Reflexión: Abre el desglose en la nueva tarea. ¿Qué categorías volvieron al valor base? ¿Cuáles habrían seguido creciendo si te hubieras quedado en la tarea anterior?
Próximos pasos
En este tutorial, aprendiste a gestionar la ventana de contexto de forma efectiva. Leíste el desglose, mediste la cantidad de sobrecarga fija de tokens, viste cómo Messages aumentó después de un prompt de list-files y restableciste con + (Nueva tarea).
- Gestión de la ventana de contexto: Umbral de condensación, impacto de MCP y buenas prácticas.
- Reglas personalizadas: Qué llena Rules.
- Skills: Qué llena Skills.
Genera código seguro con un flujo de trabajo actor-crítico
Usa IBM Bob para configurar reglas de seguridad y aplicar un patrón actor-crítico para generar código Python que satisfaga los marcos de seguridad antes de que llegue a una herramienta de análisis estático.
Mantener la documentación sincronizada con tu base de código
Aprende a mantener la documentación técnica sincronizada con tu base de código usando el comando init de IBM Bob y un modo Docs Architect personalizado en escenarios de desarrollo reales — desarrollo de funcionalidades, revisiones de código, incorporación y mantenimiento continuo.