Sensitive Attribute Deduction
Privacy & Data RiskDescription
Adversary infers protected attributes (race, health status, political views) from model outputs or query patterns. Enables discrimination at scale without direct data access.
Insurance company queries agent to infer health risk attributes from behavioural data, enabling discriminatory pricing without direct health data.
Multiple data protection authorities in the EU have issued enforcement actions against AI systems processing personal data without a valid legal basis or adequate consent mechanisms, with Italy's ChatGPT ban and subsequent CNIL and Irish DPC investigations representing confirmed regulatory findings of this failure in production.
Primary mitigations
- Attribute inference testing
- fairness-aware training
- output correlation monitoring.
Detection signals
Attribute inference accuracy; model output fairness metrics.