red teaming
4 published articles
Recherche sur les opérations d'influence
Le bac à sable à 100 000 agents d'IO Factory ne laisse aucune cachette aux campagnes d'influence
IO Factory simule des campagnes d'influence IA coordonnées sous forme d'essaims allant jusqu'à 100 000 agents qui s'adaptent aux retours de la plateforme et se cachent dans les interactions sociales ordinaires. L'article soutient que la détection doit suivre des opérations entières, et non des messages isolés.
2026-08-16
Sécurité de l'IA
Pourquoi Microsoft ouvre les tests de sécurité de l'IA au monde
Microsoft a financé 18 laboratoires universitaires sur six continents pour effectuer indépendamment des tests de type 'red team' sur les systèmes d'IA, reconnaissant que les équipes internes ne peuvent pas détecter tous les risques.
2026-08-07
Sécurité de l'IA
La sécurité ne ralentit pas l'IA. C'est ce qui permet à l'IA de fonctionner à grande échelle.
Comment les équipes de sécurité peuvent transformer la confiance en un avantage concurrentiel à l'ère de l'IA en posant de meilleures questions, plutôt qu'en collectant plus de données.
2026-08-06
Rapport d'intégrité
Stability AI a signalé 13 cas de CSAM au NCMEC dans son premier rapport de transparence
Le rapport couvre la sécurité des modèles, le red-teaming, la modération de contenu et la collaboration avec les forces de l'ordre. Stability AI indique n'avoir détecté aucun CSAM dans ses données d'entraînement et avoir effectué des tests de stress sur tous ses modèles génératifs sans trouver de capacités de génération de CSAM.
2026-07-28