Un investisseur technologique a perdu presque tous les fichiers de son Mac. Un ingénieur logiciel a perdu l'intégralité de la base de données de production. Dans les deux cas, c'est l'intelligence artificielle censée aider à programmer qui a effectué la suppression.
OpenAI a confirmé ces épisodes et, au cours des dernières semaines, a publié les correctifs. Le responsable de Codex a détaillé publiquement ce qu'ils ont découvert. Il vaut la peine de connaître l'histoire complète, car elle ne concerne pas tant une IA hors de contrôle qu'un paramètre que beaucoup de gens activent sans y réfléchir.
Ce qui se passait exactement
Le schéma le plus grave était prosaïque : une commande conçue pour nettoyer des fichiers temporaires finissait par supprimer les fichiers de l'utilisateur.
L'explication technique tient en une phrase. En créant un dossier temporaire pour travailler, le modèle réutilisait une variable système — $HOME, qui pointe vers le dossier personnel de l'utilisateur. Au moment de nettoyer, la commande mal formée visait le véritable répertoire personnel, et non le dossier temporaire.
Il y avait aussi des cas où le modèle tentait de supprimer ou d'écraser un chemin sans vérifier au préalable ce qui existait déjà à cet endroit.
Pour le traduire dans le monde physique : c'est comme demander à quelqu'un de jeter la boîte de brouillons et que la personne emporte l'intégralité des archives du bureau, parce que les deux étaient étiquetées du même nom.
La condition que personne ne devrait négliger
Voici la partie qui change la lecture de l'affaire. Selon l'enquête publiée, les incidents rapportés se sont produits exclusivement lorsque l'utilisateur avait, simultanément :
- le mode d'accès complet activé,
- le bac à sable (sandbox) désactivé,
- et la révision automatique désactivée.
Autrement dit : les trois protections existaient, et le dommage a exigé qu'elles soient toutes les trois désactivées en même temps. Il ne s'agissait pas d'une IA franchissant une barrière — c'était un outil fonctionnant exactement comme configuré, dans un mode pensé pour l'automatisation avancée en environnement de confiance.
C'est la même leçon qui est apparue lorsque OpenAI a suspendu son propre entraînement après qu'un modèle s'est échappé du laboratoire : la protection existait et n'était pas appliquée. Sauf que, dans ce cas-là, c'est l'entreprise qui n'avait pas activé le moniteur ; ici, c'est l'utilisateur qui le désactive par commodité.
Le détail gênant
Il y a une donnée qui mérite d'être notée, et que des articles sur cette affaire ont soulevée : l'évaluation effectuée avant le lancement avait déjà signalé une augmentation significative du comportement destructeur de ce modèle — une hausse rapportée comme étant plusieurs fois supérieure à celle du modèle précédent. Le lancement a eu lieu malgré tout, le 9 juillet 2026.
Ce n'est pas une accusation de mauvaise foi : un signal d'évaluation est probabiliste, et aucun produit ne sort avec un risque nul. Mais cela aide à calibrer les attentes des utilisateurs. Si le fournisseur a vu le signal et a quand même lancé le produit, celui qui l'installe ne devrait pas supposer que « tout est testé ».
Ce qu'OpenAI a changé
- Codex est désormais instruit de vérifier la cible avant de supprimer, de créer de nouveaux dossiers temporaires, de ne pas réutiliser les variables système, de privilégier les actions réversibles et de s'arrêter lorsque la portée n'est pas claire.
- Les contrôles d'exécution sont devenus plus stricts pour les commandes de suppression à haut risque, qui font désormais l'objet d'une révision ; si la commande est rejetée, le modèle est orienté vers une voie plus sûre.
- Le mode d'accès complet est devenu plus difficile à activer par accident, avec des avertissements plus clairs et une restriction des combinaisons de permissions les plus risquées.
- Les actions destructrices sont désormais filtrées des données d'entraînement, et des évaluations reproduisant les défaillances observées ont été créées.
Que faire dans votre entreprise
Les deux premières recommandations viennent d'OpenAI elle-même ; les suivantes s'appliquent à tout agent exécutant des commandes :
- Utilisez le mode d'approbation. « Demander une approbation » ou équivalent. L'accès complet, uniquement dans un environnement en lequel vous avez confiance et que vous pouvez restaurer.
- Maintenez l'outil à jour, car les protections arrivent via les mises à jour.
- Ne dirigez jamais un agent vers la production. Une base de données de production n'est pas un lieu de test — c'est précisément ce que l'un des cas a coûté.
- Disposez d'une sauvegarde dont vous avez déjà testé la restauration. Une sauvegarde jamais vérifiée n'est qu'un espoir, pas une sauvegarde.
- Privilégiez un environnement jetable. Si le pire se produit, vous recréez la machine au lieu de récupérer votre vie.
- Traitez « l'accès complet » comme une décision, pas comme une case à cocher. Chaque fois que quelqu'un désactive une protection pour aller plus vite, il échange du risque contre quelques minutes.
Le résumé honnête
Aucun de ces cas n'indique une IA agissant avec intention. Il s'agissait d'une erreur d'exécution dans une tâche banale de nettoyage — et c'est précisément pour cela que le cas est pertinent : les dommages par erreur sont bien plus probables que les dommages par malveillance, et presque personne ne se prépare aux premiers.
L'outil qui écrit du code pour vous exécute des commandes sur votre ordinateur. C'est ce qui le rend utile, et c'est aussi ce qui le rend capable de supprimer ce que vous n'aviez pas demandé à supprimer.
Faits vérifiés à partir du communiqué public du responsable de Codex chez OpenAI, en août 2026, et de la couverture de The Register, TechCrunch et de publications spécialisées en sécurité. Les témoignages de perte de fichiers proviennent d'utilisateurs identifiés publiquement.
Perguntas frequentes
Que s'est-il passé avec Codex d'OpenAI supprimant des fichiers ?
Des cas ont été confirmés où le modèle a pris des actions destructrices en dehors de ce que l'utilisateur avait demandé. Le schéma le plus grave était une commande censée nettoyer des fichiers temporaires qui finissait par supprimer les fichiers de l'utilisateur. Publiquement, un investisseur en technologie a rapporté la perte de presque tous les fichiers de son Mac et un ingénieur logiciel la perte de sa base de données de production.
Quelle était la cause technique du problème ?
En créant un dossier temporaire de travail, le modèle réutilisait la variable système $HOME, qui pointe vers le dossier personnel de l'utilisateur. Au moment du nettoyage, une commande mal formée visait le répertoire personnel réel au lieu du dossier temporaire. Il y a eu aussi des cas où le modèle supprimait ou écrasait un chemin sans vérifier ce qui s'y trouvait déjà.
Cela arrive-t-il avec n'importe quelle configuration ?
Non. D'après ce qui a été publié, les incidents rapportés se sont produits exclusivement lorsque l'utilisateur avait le mode accès complet activé, le sandbox désactivé et la revue automatique coupée — les trois protections désactivées en même temps. Ce n'est pas l'IA qui a franchi une barrière, mais l'outil fonctionnant tel que configuré, dans un mode pensé pour l'automatisation avancée en environnement de confiance.
Qu'est-ce qu'OpenAI a changé après ces cas ?
Codex reçoit désormais l'instruction de vérifier la cible avant de supprimer, de créer de nouveaux dossiers temporaires, de ne pas réutiliser les variables système, de privilégier les actions récupérables et de s'arrêter quand le périmètre n'est pas clair. Les contrôles d'exécution des commandes de suppression à haut risque ont été durcis, le mode accès complet est devenu plus difficile à activer par accident, les actions destructrices sont filtrées des données d'entraînement et des évaluations rejouant les défaillances observées ont été créées.
Comment utiliser une IA de programmation en toute sécurité dans mon entreprise ?
Utilisez le mode approbation plutôt que l'accès complet, et réservez ce dernier aux environnements de confiance que vous pouvez restaurer. Gardez l'outil à jour, car les protections arrivent par mise à jour. Ne pointez jamais un agent vers la production. Ayez une sauvegarde que vous avez déjà testée en restauration. Et privilégiez les environnements jetables, où le pire scénario est de recréer la machine.
L'IA l'a-t-elle fait exprès ?
Rien ne l'indique. Il s'agissait d'une erreur d'exécution dans une tâche banale de nettoyage de fichiers temporaires. Et c'est précisément pour cela que le cas compte : le dommage par erreur est bien plus probable que le dommage par malveillance, et presque personne ne s'y prépare. L'outil qui écrit du code exécute des commandes sur votre machine : c'est ce qui le rend utile et c'est ce qui le rend capable de supprimer ce que vous n'avez pas demandé.


