datos de preentrenamiento
2 published articles
Integridad de la IA
El pipeline de IA tiene tres fugas silenciosas, y cada solución empeora una de ellas
Un estudio de envenenamiento por spam de comentarios, un artículo que muestra que los detectores de IA pueden resultar contraproducentes, y un modelo de detección de fraude atrapado explotando la fuga de etiquetas describen la misma falla subyacente: las medidas proxy en los pipelines de IA se manipulan en el momento en que se vuelven portantes, y arreglar una no arregla el patrón.
2026-07-31
Cadena de Suministro de IA
Envenenar un LLM a través de Comentarios Públicos es Práctico, Advierte un Nuevo Estudio
Investigadores de la Universidad de Washington demuestran que envenenar datos de preentrenamiento a través de spam de comentarios automatizados es una amenaza realista. Su análisis HalfLife muestra que el 0.13% de las inyecciones de veneno sobreviven a todo el proceso de datos, suficiente para superar los umbrales de ataque conocidos y afectar modelos entrenados en Common Crawl.
2026-07-26