Transparencia en IA
2 published articles
Transparencia en IA
La marca de agua invisible de Claude está por llegar. Una reescritura completa la elimina
Anthropic añadirá una marca de agua invisible a los futuros modelos de Claude para cumplir las normas de la Ley de IA de la UE sobre el marcado de contenido generado por IA. Es gratuita e imposible de rastrear, pero pasa por alto el código exacto, los pasajes cortos y el texto completamente reescrito.
2026-08-21
Interpretabilidad en IA
Las decisiones de tu red neuronal ahora se pueden rastrear hasta casos de entrenamiento específicos
Investigadores muestran que las puntuaciones de acción de redes neuronales pueden expresarse como sumas ponderadas exactas de retornos de casos de entrenamiento, utilizando la geometría de Gram. Esto permite señales de auditoría posteriores al entrenamiento que identifican casos influyentes, miden la coherencia de la acción y señalan soporte débil, sin reentrenar ni acceder a la trayectoria de optimización original.
2026-08-03