En un ataque de extracción de modelo, un atacante realiza una gran cantidad de consultas a un modelo de IA a través de su API pública, y usa las respuestas obtenidas como datos de entrenamiento para construir su propio modelo, que imita el comportamiento del original sin haber tenido acceso a sus parámetros internos.
Por qué preocupa a las organizaciones
Representa un riesgo tanto de propiedad intelectual (replicar un producto que costó una inversión enorme entrenar) como de seguridad, ya que un modelo extraído también podría heredar y exponer más fácilmente ciertas vulnerabilidades del modelo original.
