Search the Atlas

Search risks, controls, and glossary terms

MediumOutput HandlingTheoretical

Improper output handling (downstream injection)

Security & Robustness

Description

Unsanitised model output is passed to downstream systems, enabling XSS, SQL injection, or command execution.

Example scenario

Model-generated text rendered in a dashboard executes script (XSS) in an officer's browser.

Real-world evidenceTheoretical

While adversarial evasion is well-demonstrated, deliberately targeting high-uncertainty decision regions as a distinct attack strategy—rather than generic adversarial perturbations—lacks empirical validation as a confirmed attack method in any production deployment. The risk is plausible from known model properties but not yet shown in structured experiments targeting this specific mechanism.

No public incident on record — evidence level: Theoretical

Primary mitigations

  • Treat output as untrusted
  • context-aware encoding/escaping
  • output validation
  • parameterised queries
  • CSP.

Detection signals

Output-sanitisation testing; downstream injection scanning.

Mitigating controls

4
Non-agentic controls

Related risks in Security & Robustness