Prompteo

Unidad 5 · 2 min

Ingeniería de contexto

Qué información darle al modelo y cómo: documentos largos, RAG en términos simples y chats que se contaminan.

Mirá la unidad como una conversación con Claude. Abajo está escrita, para volver a buscar un comando sin rebobinar.

Ingeniería de contexto

El contexto es todo lo que el modelo ve al generar: tus instrucciones, los documentos pegados y el historial del chat. Administrarlo bien es tan importante como redactar bien el pedido.

Qué incluir: lo relevante para la tarea — el objetivo, los datos necesarios y el formato esperado. Más contexto no siempre es mejor: material irrelevante diluye lo importante y puede empeorar la respuesta.

Documentos largos: en lugar de pegar todo y preguntar, funciona mejor una estrategia en dos fases: primero pedir resúmenes por sección, luego hacer las preguntas sobre el resumen y volver al original solo cuando se necesita el detalle exacto.

RAG (retrieval-augmented generation), en términos simples: en vez de esperar que el modelo 'sepa', un sistema busca los fragmentos relevantes en una base de documentos y los agrega al prompt junto con tu pregunta. El modelo responde con base en esos fragmentos. Es la versión automatizada del grounding.

Contaminación de contexto: en chats largos se acumulan instrucciones viejas, correcciones y temas mezclados; el modelo empieza a combinar cosas que no deberían combinarse. El remedio es empezar un chat nuevo con un resumen limpio. Y un detalle práctico: en prompts largos, las instrucciones críticas pesan más al inicio y, repetidas, al final.