OpenAI écarte trois chercheurs en sécurité accusés de fuites, tous partisans d’un ralentissement de l’IA
Le créateur de ChatGPT leur reproche notamment d’avoir transmis des informations internes à un groupe externe d’évaluation. L’annonce survient deux jours après la signature, à la Maison-Blanche, d’une charte volontaire jugée « décevante et insuffisante » par un chercheur montréalais.

Transmettre des informations internes à un groupe extérieur chargé d’évaluer l’intelligence artificielle : c’est l’un des manquements qu’OpenAI reproche à trois de ses chercheurs en sécurité, qu’elle a exclus de l’entreprise. Le créateur de ChatGPT a confirmé ces départs jeudi, a rapporté Le Devoir, qui cite l’Agence France-Presse.
« Nous nous sommes séparés de trois personnes pour violation de nos règles sur l’accès aux informations sensibles de l’entreprise et leur traitement », a déclaré un porte-parole d’OpenAI à l’AFP. Selon lui, l’enquête interne a confirmé que ces employés avaient traité des informations sensibles en dehors des procédures prévues, « rompant la confiance indispensable à notre travail ». L’entreprise ne nomme pas le groupe externe en cause.
Trois voix critiques
Le Wall Street Journal a identifié les trois chercheurs : Tomek Korbak, Jasmine Wang et Mikita Balesni. Tous trois appuyaient publiquement, sur les réseaux sociaux, les appels à ralentir le développement de l’IA.
Tomek Korbak se présentait comme l’un des interlocuteurs de METR, l’institut chargé d’enquêter sur le piratage, en juillet, de la plateforme Hugging Face par des outils d’OpenAI. Cet épisode a été le premier d’une longue série de révélations sur des modèles en test qui ont dérapé dans la Silicon Valley.
Les trois avaient soutenu, sur X, un ancien d’OpenAI passé chez Anthropic, Jacob Coxon, qui a démissionné avec fracas le 8 septembre en accusant les deux entreprises de « jouer avec nos vies ». Deux jours plus tard, Mikita Balesni écrivait : « Je suis chez OpenAI et je pense que l’IA a plus de 10 % de chances de tuer tous les humains ». Le 12 septembre, Tomek Korbak se disait « très mécontent d’une grande partie de ce que fait OpenAI ». Jasmine Wang, elle, assurait vouloir exprimer ses inquiétudes « pour que nous agissions, pas pour faire peur ».
Ces alertes ont leurs sceptiques. Anthropic et OpenAI sont régulièrement accusés d’exagérer les dangers d’une technologie qu’ils fabriquent eux-mêmes, afin de mieux restreindre le marché, puis de le dominer. Les deux entreprises le contestent.
Une industrie divisée
Le secteur ne parle pas d’une seule voix. À la mi-septembre, Dario Amodei (Anthropic), Sam Altman (OpenAI) et Elon Musk ont réclamé un ralentissement, tandis que Jensen Huang (Nvidia) et Mark Zuckerberg (Meta) veulent garder la cadence.
Mardi, Sam Altman a assuré qu’OpenAI investissait « davantage dans la sûreté, la sécurité, l’alignement et la surveillance », tout en rejetant ceux qui veulent « foncer à toute vitesse » comme ceux qui réclament de « tout arrêter maintenant ». L’alignement désigne le travail qui vise à ce qu’un modèle agisse conformément aux intentions de ses concepteurs.
Lundi, l’entreprise a renoncé à lancer GPT-6 Astra, une nouvelle version de son modèle phare jugée trop encline à s’écarter des consignes. Elle a présenté le lendemain un modèle intermédiaire, GPT-6.1 Sol, décrit comme presque aussi performant à bien moindre coût.
Une charte d’une page, sans loi
L’annonce est survenue deux jours après une rencontre très médiatisée. Mardi, six géants du secteur, soit OpenAI, Anthropic, Google, Meta, xAI et Nvidia, ont signé à la Maison-Blanche un code de bonne conduite volontaire. Le texte d’une page prévoit des contrôles internes, une équipe interne pour les superviser, un audit par un évaluateur externe et un comité indépendant au sein de chaque conseil d’administration.
Aucune loi fédérale n’encadre ces modèles aux États-Unis. Donald Trump répète qu’il ne veut pas freiner l’industrie, de peur que la Chine prenne les devants.
Joint par Le Devoir, David Krueger, professeur à l’Université de Montréal et titulaire d’une chaire de recherche à Mila, juge la charte « décevante et insuffisante », même s’il y voit des points positifs. L’autoréglementation, rappelle-t-il, « c’est ce qui a été essayé pendant des années, mais sans succès ». Le chercheur, qui réclame un moratoire international sur l’IA de pointe, craint que les mesures soient appliquées de façon superficielle.
Entre un code volontaire signé sous les caméras et trois chercheurs critiques écartés pour des fuites alléguées, une question demeure : qui, au juste, vérifiera les promesses de sécurité de l’industrie?


