Un ejemplo adversarial es el resultado concreto de un ataque adversarial: una entrada modificada de forma calculada, muchas veces indistinguible de la original para una persona, pero que provoca un error específico y predecible en un modelo de IA.
Por qué son útiles más allá del ataque
Además de representar un riesgo de seguridad, generar y estudiar ejemplos adversariales ayuda a los investigadores a entender mejor las debilidades de un modelo, y a entrenarlo de forma más robusta incluyendo esos ejemplos difíciles dentro de su propio proceso de entrenamiento.
