Ingeniería de contexto
En una frase: es elegir qué información ve la IA en cada paso.
La IA solo ve lo que cabe en su «ventana». Ahí entran instrucciones, herramientas, documentos, historial y notas.
Anthropic, la empresa de Claude, da un consejo. Usa el menor texto posible que te lleve al resultado.
Cómo se ve
En qué se diferencia de escribir un prompt
- Escribir un prompt es redactar bien las instrucciones que le das a la IA.
- La ingeniería de contexto cuida todo lo que llega al modelo, no solo el prompt.
- Eso incluye herramientas, datos externos, historial y resultados anteriores.
- Se repite cada vez que algo se pasa al modelo.
Las pautas para escribir prompts están en Prompting práctico por modelo. Lo que se carga en todas las conversaciones tiene su ficha: Instrucciones persistentes.
Qué pasa, paso a paso
Por qué el contexto es limitado
- Si la ventana tiene mucho texto, a la IA le puede costar encontrar algo.
- Se llama context rot, o «podredumbre del contexto». En las pruebas de Anthropic, empeora poco a poco.
- Cuánto empeora depende del modelo y de la tarea.
- Anthropic habla de un «presupuesto de atención». Es una comparación: el contexto es limitado.
- El detalle técnico está en Ventana de contexto.
Las piezas
- Instrucciones del sistema: ni reglas rígidas ni pautas vagas. Se escriben en secciones claras.
- Se empieza con lo mínimo y se añade según los fallos que se vean.
- Herramientas: pocas, que no se solapen y que devuelvan poco texto.
- Si una persona no sabría cuál usar, la IA tampoco.
- Ejemplos: unos pocos, variados y representativos. Mejor eso que una lista larga de casos raros.
Cargar antes o justo a tiempo
- Antes: se busca lo importante antes de que la IA responda. Es la idea de RAG.
- Justo a tiempo: la IA guarda solo referencias, como rutas o enlaces. Carga el dato cuando lo necesita.
- Es como llevar en la mochila el índice de la biblioteca, no los libros.
- Mezcla de ambas: Claude Code carga al principio sus archivos de instrucciones. El resto lo busca sobre la marcha, que es más lento y necesita buena guía.
- Hay reglas que solo se cargan al trabajar con ciertos archivos. La guía oficial recomienda instrucciones cortas: las largas gastan ventana y se siguen peor.
- Con las skills y las herramientas conectadas pasa igual. Al principio solo se ve su descripción.
Tareas largas
- Compactar: se resume la conversación cerca del límite y se sigue con el resumen.
- Lo más ligero es borrar los resultados viejos de herramientas.
- Notas: la IA escribe notas fuera de la ventana y las relee después. Es como un cuaderno de apuntes.
- Subagentes: ayudantes con ventana limpia que devuelven solo un resumen. Sirven para investigar en paralelo.
- Empezar de cero: abrir una ventana nueva en lugar de compactar.
- Los modelos actuales recuperan el estado desde archivos si les dices por dónde empezar.
Por qué importa
- Gestionar el contexto es una de las dos funciones del arnés. La otra es darle herramientas.
- Un agente acumula resultados e historial. Sin cuidado, rinde peor cuanto más dura la sesión.
- Separar lo que se carga siempre de lo que se carga bajo demanda ahorra ventana.
Un ejemplo de la vida real
Imagina un trabajo largo del instituto con ayuda de una IA.
- Siempre cargado, y corto: el tema, la fecha y lo que pidió el profesor.
- Solo cuando hace falta: las normas para citar fuentes, cuando llegues a la bibliografía.
- Si la conversación se alarga: pides un resumen con objetivo, lo hecho y siguiente paso. Lo pegas en un chat nuevo.
- Para revisar muchas fuentes: un ayudante las lee y te devuelve solo un resumen.
Es un ejemplo inventado. En Claude Code se hace algo parecido. Unas instrucciones se cargan siempre y otras reglas solo entran con ciertos archivos.
Pruébalo tú
- ¿Por qué no conviene pegar en el chat todos tus apuntes del curso?
- La conversación se acerca al límite y no quieres perder el hilo. ¿Qué técnica usarías?
Respuestas
- Porque con mucho texto le puede costar más encontrar lo importante. Es mejor dar lo mínimo útil.
- Compactar: resumir la conversación y seguir con el resumen. También sirve escribir una nota de relevo y abrir un chat nuevo.
Palabras clave
- Ventana de contexto: todo el texto que la IA puede ver a la vez.
- Token: pieza de texto con la que trabaja el modelo.
- Context rot: con mucho texto, a la IA le puede costar encontrar algo.
- Compactación: resumir la conversación para seguir con menos texto.
- Subagente: ayudante con ventana propia que devuelve solo un resumen.