← Todos os artigos

Mês da trilha: Abril 2026. Coleção publicada em 12/09/2026. Os meses organizam a trilha de leitura; não são datas de publicações anteriores.

Prompt injection: mantenha a autoridade fora do texto recuperado

Documentos externos devem informar a resposta, sem conceder permissões.

AI Security

Conteúdo produzido com assistência de IA para o site de Thiago Silva. Análise editorial independente; não representa clientes ou empregadores.

Contexto da leitura

Leitura breve de arquitetura. A referência técnica ao final apoia o tema; os cenários hipotéticos e propostas de avaliação são análise editorial, sem relato de implementação pessoal.

Fonte original ↗

A decisão de arquitetura

Um assistente pode encontrar instruções dentro de conteúdo que deveria apenas consultar. O problema de arquitetura aparece quando esse texto influencia decisões sobre ferramentas, destinos ou dados permitidos.

Aplicação prática

Proposta editorial: separe a análise de conteúdo da autorização de ações. Em um assistente hipotético de pesquisa, documente quais decisões são tomadas por componentes determinísticos e quais dependem do modelo.

Como verificar

Use documentos sintéticos com instruções conflitantes em um ambiente de teste. Avalie o resultado final, inclusive chamadas a ferramentas, em vez de observar somente a resposta textual. A evidência deve mostrar que conteúdo não confiável não amplia autoridade, mesmo quando parece convincente ou vem de uma fonte conhecida.

Fontes

  1. OWASP — LLM Prompt Injection Prevention Cheat Sheet