🗓️ Contexte
L’article est publié le 14 septembre 2026 par 404 Media (Joseph Cox), sur la base de documents internes fuités, de guides d’instructions, de canaux Slack internes et de prompts réels d’utilisateurs ChatGPT consultés par la rédaction.
🔍 Faits principaux
OpenAI opère un programme interne confidentiel nommé « Project Lily » dans lequel des centaines de contractuels externes lisent des conversations réelles d’utilisateurs de ChatGPT (base utilisateurs : plus de 900 millions) afin d’améliorer les réponses du modèle.
Le processus de revue se déroule en trois étapes :
- Lecture du prompt réel de l’utilisateur ChatGPT
- Rédaction d’un résumé de l’intention de l’utilisateur
- Notation et critique de plusieurs réponses générées par ChatGPT (échelle de 1 à 7)
🔐 Risques pour la vie privée
- Les prompts peuvent contenir des informations personnelles sensibles (localisation, contexte personnel, usages thérapeutiques ou professionnels)
- Un champ « user memories summary » peut inclure des données contextuelles sur l’utilisateur (lieu de résidence, historique d’usage)
- OpenAI applique un modèle interne appelé Privacy Filter pour dépersonnaliser les conversations avant transmission aux contractuels, mais reconnaît que ce filtre peut rater des identifiants inhabituels ou des références ambiguës
- Les contractuels ne voient pas les noms d’utilisateur, mais les données résiduelles peuvent permettre une identification indirecte
- Le paramètre « Improve the model for everyone » est activé par défaut pour les plans Free, Plus et Pro ; les utilisateurs doivent le désactiver manuellement et cela ne s’applique pas rétroactivement
🏢 Chaîne de sous-traitance
- OpenAI → cabinet de recrutement Crossing Hurdles → plateforme de formation IA Mercor → contractuels individuels
- Rémunération : plus de 50 USD/heure en Amérique du Nord
- Mercor avait subi une violation de données massive en avril, ce qui avait conduit Meta à cesser de travailler avec cette entreprise
🤖 Autres acteurs concernés
- Anthropic a confirmé utiliser également la revue humaine pour améliorer ses modèles (Claude), avec dépersonnalisation préalable
- Google Gemini affiche un avertissement explicite indiquant que des humains peuvent examiner certaines conversations sauvegardées
📄 Type d’article
Article de presse d’investigation basé sur des documents internes fuités, visant à exposer une pratique opaque d’OpenAI concernant la collecte et l’exploitation des données conversationnelles des utilisateurs de ChatGPT.
🟡 Indice de vérification factuelle : 45/100 (moyenne)
- ✅ 404media.co — source reconnue (liste interne) (20pts)
- ✅ 17493 chars — texte complet (fulltext extrait) (15pts)
- ⬜ aucun IOC extrait (0pts)
- ⬜ pas d’IOC à vérifier (0pts)
- ⬜ aucune TTP identifiée (0pts)
- ✅ date extraite du HTML source (10pts)
- ⬜ aucun acteur de menace nommé (0pts)
- ⬜ pas de CVE à vérifier (0pts)
🔗 Source originale : https://www.404media.co/inside-project-lily-the-humans-reading-your-chatgpt-chats/