MITRE ATLAS 2026 Top AI Detection: Sensitive Data Leakage in LLM Response Output (AML.T0057)

Detects Large Language Model (LLM) responses that contain sensitive information such as PII, internal proprietary markers, or credentials. This rule monitors model output for patterns matching social security numbers, credit card numbers, private keys, API keys, and internal company confidentiality labels, which could indicate data leakage or unintended disclosure.