Envenenamiento de Datos (Data Poisoning) y Backdoors en Modelos de IA: Técnicas de Mitigación y Sanitización
Manipular apenas el 0.01% de un dataset de entrenamiento basta para incrustar puertas traseras ocultas en una red neuronal sin degradar su rendimiento aparente. Analizamos los vectores de ataque de Data Poisoning, triggers subliminales en visión y lenguaje, y algoritmos de sanitización espectral bajo el marco MITRE ATLAS.
Read more