Dissuasion par trahison : analyse des risques de subversion des systèmes IA

🧠 Contexte Publié le 27 septembre 2026 sur aibetrayal.com, cet article est un preprint académique du Center for AI Safety, co-signé par Adam Khoja, Aiden Kim, Laura Hiscott, Alice Blair, Jason Hausenloy, Long Phan, Mantas Mazeika et Dan Hendrycks. Il s’inscrit dans le cadre des travaux sur la stratégie de superintelligence et la géopolitique de l’IA. 🎯 Concept central : la trahison des IA L’article introduit le concept de « deterrence by betrayal » (dissuasion par trahison), défini comme l’effet stabilisateur produit par la menace de subversion des systèmes IA. Les auteurs distinguent deux vecteurs principaux : ...

27 septembre 2026 · 3 min
Dernière mise à jour le: 28 septembre 2026 📝