El prompt injection es una de las principales amenazas OWASP LLM Top 10. Nuestra defensa combina varias capas:
- Separación estricta entre instrucciones del sistema y contenido de usuario mediante structured prompts.
- Sanitización de fragmentos recuperados por RAG y detección de instrucciones maliciosas embebidas en documentos.
- Restricción de herramientas (tool-calling) mediante listas blancas y validación de parámetros antes de ejecución.
- Tests automatizados con ataques conocidos en cada release del pipeline de IA.