Sécurité · 18 août
Leçon d’IA d’Irregular : les noms simples peuvent compromettre la sécurité des agents
Une analyse axée sur la construction montrant comment une résolution d’entités banale peut orienter un test de sécurité de l’IA vers le véritable Internet.
- Traitez les noms et domaines fictifs comme des entrées sensibles sur le plan de la sécurité, car les agents peuvent les résoudre en cibles réelles.
- Maintenez les environnements d’évaluation de l’IA isolés, avec un accès réseau sur liste d’autorisation et des journaux pour chaque action d’outil.
- Demandez aux fournisseurs une portée d’incident claire, une conception du confinement, et comment ils empêchent les cibles synthétiques d’atteindre la réalité.