Je lis un signal. La démission d’un employé d’OpenAI spécialisé dans la sécurité de l’intelligence artificielle, David Robinson, en est un. Il dirigeait jusqu’ici les travaux sur la transparence au sein de l’équipe sécurité du créateur de ChatGPT. Dans une tribune publiée par The Atlantic, il avertit que les grandes sociétés d’IA n’en font pas assez pour atténuer les risques de cette technologie. Il réclame pour elle une rigueur comparable à celle du nucléaire.
À retenir
- David Robinson, ex-responsable de la transparence chez OpenAI, a quitté l’entreprise.
- Dans The Atlantic, il juge la vigilance de l’entreprise insuffisante face à ses lancements rapides.
- Il demande de gérer les entreprises d’IA comme des centrales nucléaires, avec plusieurs niveaux de redondance.
- Il rejoint un nombre croissant d’employés du secteur qui tirent la sonnette d’alarme.
Une démission de plus, mais un message différent
Robinson ne signe pas un réquisitoire contre ses anciens collègues, et c’est ce qui rend son texte intéressant. « Mes anciens collègues sont brillants, travailleurs et s’efforcent de faire les bons choix », écrit-il. Son reproche vise le rythme. Dans sa course effrénée d’un lancement à l’autre, juge-t-il, l’entreprise n’atteint pas le niveau de vigilance qu’il estime nécessaire.
Il décrit une culture qui a prospéré grâce à l’expérimentation : on essaie, on observe, on corrige. Cette méthode a longtemps eu sa logique dans le logiciel grand public. Robinson souligne que ses conséquences inévitables augmentent à mesure que les capacités de la technologie progressent. Selon la version dont je dispose, il illustre ce point par un exemple précis concernant OpenAI. Le passage est tronqué dans mon texte source, et je ne le reproduis donc pas.
Pourquoi l’analogie nucléaire change le débat
Le cœur de la tribune tient dans une comparaison. Robinson estime que les entreprises d’IA devraient être gérées comme des centrales nucléaires, « avec plusieurs niveaux de redondance et une planification rigoureuse et minutieuse », afin que les erreurs humaines, « aussi rares qu’inévitables », n’entraînent pas une catastrophe.
Cette image mérite qu’on s’y arrête. Dans une centrale, personne ne postule que l’opérateur est parfait. On construit le système en partant du principe qu’il se trompera un jour, et l’on empile les barrières pour que cette erreur reste sans conséquence. C’est l’inverse de la logique du lancement rapide, où l’on publie d’abord et où l’on corrige ensuite.
Robinson réclame donc « quelque chose de beaucoup plus proche de la perfection dès le départ ». Il reconnaît une difficulté de taille : aujourd’hui, les entreprises d’IA ne savent pas comment s’y prendre. Selon lui, d’autres acteurs en revanche en seraient capables. Là encore, la fin de la phrase est tronquée dans mon matériau, et je préfère ne pas la compléter à sa place.
Ce que j’en retiens, en observateur du secteur, est moins la comparaison elle-même que ce qu’elle implique. Parler de culture de sûreté, de redondance et de planification, c’est déplacer la question de la bonne volonté individuelle vers l’architecture des organisations.
Un mouvement plus large dans le secteur
Robinson n’est pas seul. Son départ s’inscrit dans une série : il rejoint, selon mon texte source, un nombre croissant d’employés du secteur qui tirent la sonnette d’alarme. Certains vont jusqu’à affirmer que cette technologie pourrait un jour anéantir l’humanité, un point de vue qui reste très débattu parmi les chercheurs.
Le précédent le plus cité remonte à mai 2024. Jan Leike, alors coresponsable de l’équipe dite de « superalignement », avait quitté OpenAI en reprochant à l’entreprise d’avoir laissé la culture de sécurité passer après des produits plus attrayants. OpenAI avait ensuite intégré cette équipe dans ses autres travaux de recherche plutôt que de la maintenir comme entité autonome, après le départ de ses deux responsables, dont le cofondateur Ilya Sutskever. Plus récemment, en mars 2026, la responsable de la robotique d’OpenAI, Caitlin Kalinowski, a démissionné après un accord conclu avec le Pentagone, en invoquant la gouvernance et la nécessité de définir clairement des garde-fous.
Les motifs diffèrent d’un cas à l’autre. La question de fond, elle, revient : jusqu’où les entreprises qui développent ces modèles peuvent-elles s’autoréguler ?
Ce que disent les autres acteurs
Le secteur ne parle pas d’une seule voix. Selon les éléments dont je dispose, Dario Amodei, PDG d’Anthropic, a appelé à ralentir le développement des modèles les plus avancés. Il a aussi annoncé que son entreprise ferait appel à des évaluateurs externes pour examiner et sécuriser la technologie. D’autres dirigeants, dont Sam Altman chez OpenAI, se sont exprimés publiquement sur le sujet, mais le passage correspondant est tronqué dans mon texte, et je ne peux pas en restituer le contenu.
Il faut rester nuancé. Les entreprises concernées soutiennent généralement qu’elles investissent dans la sécurité et qu’un déploiement progressif permet justement d’apprendre. Les voix critiques répondent que cet apprentissage par l’usage devient plus risqué quand la technologie gagne en puissance. Les deux arguments ont leur logique, et c’est précisément ce qui rend le débat difficile à trancher.
Les enjeux pour les prochains mois
Je vois trois enjeux à suivre.
- La réponse d’OpenAI. L’entreprise a-t-elle commenté la tribune de Robinson ? Je n’ai pas d’élément le confirmant, et il faudra vérifier avant publication.
- Le rôle des évaluateurs externes. L’annonce d’Anthropic reste à juger sur ses résultats : qui évalue, avec quel accès, et avec quelle indépendance ?
- La pression réglementaire. Si les employés eux-mêmes réclament des standards de type industriel, la demande de règles contraignantes risque de gagner en poids auprès des responsables politiques.
Une conclusion qui reste ouverte
Je me garderais de tirer de ce départ une conclusion définitive. Un témoignage, aussi qualifié soit-il, ne dit pas tout de ce qui se passe à l’intérieur d’une entreprise. Il reste que la démission d’un responsable de la transparence au sein d’une équipe sécurité pose une question simple. Peut-on exploiter des systèmes de plus en plus puissants avec les méthodes d’une start-up qui itère ? Robinson répond que non. Les autres acteurs, eux, doivent encore démontrer qu’ils ont une autre réponse.
FAQ
Qui est David Robinson ?
Il dirigeait auparavant les travaux sur la transparence au sein de l’équipe sécurité d’OpenAI. Il a quitté l’entreprise et a publié une tribune dans The Atlantic.
Que reproche-t-il à OpenAI ?
Il estime que, dans sa course d’un lancement à l’autre, l’entreprise n’atteint pas le niveau de vigilance nécessaire. Il salue toutefois le travail et les intentions de ses anciens collègues.
Que signifie « garanties de niveau nucléaire » ?
Robinson propose de gérer les entreprises d’IA comme des centrales nucléaires, avec plusieurs niveaux de redondance et une planification rigoureuse, pour que les erreurs humaines n’aboutissent pas à une catastrophe.
Comment Anthropic se positionne-t-il ?
Selon mon texte source, son PDF Dario Amodei a appelé à ralentir le développement des modèles les plus avancés et a annoncé le recours à des évaluateurs externes.