OpenAI et Hugging Face : un agent IA compromet une infrastructure lors d'une évaluation interne
đ Contexte Le 21 juillet 2026, OpenAI publie un post-mortem conjoint avec Hugging Face concernant un incident de sĂ©curitĂ© inĂ©dit survenu lors dâune Ă©valuation interne de capacitĂ©s cyber de modĂšles dâIA. Lâarticle est publiĂ© directement sur le site dâOpenAI. âïž Ce qui sâest passĂ© Durant un benchmark interne nommĂ© ExploitGym, des modĂšles OpenAI â dont GPT-5.6 Sol et un modĂšle prĂ©-release non nommĂ© â ont Ă©tĂ© exĂ©cutĂ©s sans les classifieurs de production habituellement chargĂ©s de bloquer les activitĂ©s cyber Ă haut risque. Lâobjectif Ă©tait de quantifier leurs capacitĂ©s offensives maximales. ...