Attaques Adversariales
sur Agents RL
Explorez les stratégies d'attaque optimales contre les agents RL sur les contextes test-time, training-time, et multi-agent. Des perturbations adversariales de base aux attaques backdoor sophistiquées.
Attaques Test-Time
Perturbations adversariales, évasion, corruption d'observations
- FGSM & PGD sur politique RL
- Évasion apprentissage renforcé
- Perturbations imperceptibles
Attaques Training-Time
Empoisonnement données, backdoors, manipulation récompenses
- Experience replay empoisonnée
- Reward hacking
- Attaques gradient
Attaques Multi-Agent
Agents adversariaux, coordination, théorie jeux
- Attaques non-oblivieuses
- Usurpation d'identité agent
- Coordination essaim
Attaques Backdoor
Trojans triggers, gaming spécifications, attaques latentes
- Contrôle par trigger
- Agents dormants
- Injection valeur latente