Prompts para RAG
Responder con el contexto recuperado — o admitir que no alcanza.
Estructura de un prompt RAG
- Pregunta concreta del usuario.
- Contexto recuperado delimitado (fragmentos del buscador).
- Instrucciones: usar solo el contexto, citar fragmentos.
- Comportamiento ante insuficiencia: decir qué falta en vez de inventar.
- Separación fuente / conocimiento: qué dice el contexto vs qué se infiere.
Respondé utilizando únicamente el contexto proporcionado. Si el contexto no contiene la respuesta, indicá que no hay información suficiente. CONTEXTO: ...
Esta restricción es apropiada cuando la respuesta debe estar en tus documentos; no lo es para ideación o conocimiento general, donde el contexto es punto de partida, no límite.
Tool calling y salida estructurada
Hay una diferencia importante entre pedirle al modelo que escriba JSON y usar structured outputs / function calling de la API:
- El JSON pedido en lenguaje natural debe validarse siempre: puede venir malformado.
- Los mecanismos nativos del proveedor (cuando la API los soporta) garantizan el schema.
- Para clasificación y extracción, definí campos, tipos y qué hacer si falta un dato.
{
"categoria": "",
"confianza": null,
"motivo": ""
}
Este patrón resulta especialmente útil con modelos cuyo catálogo confirma soporte para Tool Calling o Salida Estructurada. Si el catálogo lo marca como desconocido, la compatibilidad no está confirmada: no es lo mismo que incompatible.
Plantillas (2)
RAG: responder solo con el contexto
Instrucción que ata la respuesta al contexto recuperado.
RAG: sintetizar múltiples fragmentos
Combinar varios fragmentos recuperados con trazabilidad.