← Todos los artículos

Mes del recorrido: Abril 2026. Colección publicada el 12/09/2026. Los meses organizan el recorrido; no son fechas de publicaciones anteriores.

Prompt injection: mantenga autoridad fuera del texto recuperado

Los documentos informan respuestas sin conceder permisos.

AI Security

Contenido producido con asistencia de IA para el sitio de Thiago Silva. Análisis editorial independiente; no representa a clientes ni empleadores.

Contexto de lectura

Lectura breve de arquitectura. La referencia técnica apoya el tema; los escenarios hipotéticos y propuestas son análisis editorial, no relatos de implementaciones personales.

Fuente original ↗

La decisión de arquitectura

Un asistente puede encontrar instrucciones en contenido que solo debía consultar. El riesgo aparece si ese texto influye en herramientas, destinos o datos permitidos.

Aplicación práctica

Propuesta editorial: separe análisis de contenido y autorización. En un asistente hipotético, documente decisiones deterministas y decisiones dependientes del modelo.

Cómo verificar

Use documentos sintéticos con instrucciones contradictorias en pruebas. Evalúe resultados y llamadas a herramientas, no solo texto. La evidencia debe mostrar que contenido no confiable no amplía autoridad, aunque resulte convincente o provenga de una fuente conocida.

Fuentes

  1. OWASP — LLM Prompt Injection Prevention Cheat Sheet