OpenAI licencie ses propres chercheurs : la dissidence interne a un prix
Quand les gardiens de la sécurité de l'IA se font montrer la porte
Imaginez passer des années à construire l'un des systèmes d'intelligence artificielle les plus puissants au monde — puis être écarté le jour où vous osez pointer ses dangers. Ce scénario, qui ressemble à un thriller de science-fiction, s'est produit plusieurs fois au sein d'OpenAI. Et il soulève une question qui dérange : peut-on faire confiance à une entreprise qui réduit au silence ceux qui la connaissent le mieux ?
En moins de dix-huit mois, OpenAI a perdu ou exclu une dizaine de chercheurs seniors, dont plusieurs responsables directs de la sécurité des modèles. Derrière les communiqués policés et les "départs volontaires", une tendance de fond émerge : la critique interne est devenue un risque professionnel dans la maison mère de ChatGPT.
Le contexte : une entreprise prise entre mission et marché
OpenAI a été fondée en 2015 avec une promesse explicite : développer une intelligence artificielle générale au bénéfice de l'humanité. Cette mission "non lucrative" a rapidement coexisté avec une structure commerciale générant des milliards de dollars de valorisation. Cette tension structurelle n'est pas un détail — elle est le cœur du problème.
Lorsque les intérêts commerciaux accélèrent le calendrier de déploiement des modèles, les voix qui plaident pour la prudence deviennent inconfortables. Et quand ces voix appartiennent à des chercheurs en sécurité disposant d'un accès privilégié aux systèmes internes, elles deviennent potentiellement embarrassantes.
Les cas qui ont fait basculer le débat
Ilya Sutskever et le putsch raté
En novembre 2023, le cofondateur et directeur scientifique Ilya Sutskever a participé au vote du conseil d'administration visant à renvoyer Sam Altman, PDG d'OpenAI. La raison officielle invoquée : un manque de transparence sur le rythme de développement des systèmes. Sutskever a ensuite fait marche arrière publiquement, exprimé ses regrets — et quitté l'entreprise en mai 2024. Sa sortie a coïncidé avec la dissolution du Superalignment Team, l'équipe dédiée à la sécurité à long terme de l'IA.
Jan Leike : démission fracassante et accusations directes
Co-dirigeant de cette même équipe Superalignment, Jan Leike a claqué la porte en mai 2024 avec un message public sans précédent dans le secteur. Sur X (ex-Twitter), il a écrit sans détour : "La culture de la sécurité et les processus d'OpenAI ont pris du retard sur la croissance de l'entreprise." Il a ajouté que les débats sur la sécurité étaient systématiquement perdants face aux impératifs de lancement des produits. Leike a rejoint Anthropic — l'entreprise fondée par d'anciens dissidents d'OpenAI.
Les clauses de silence : une pratique révélée par Vox
En mai 2024, une enquête de Vox a révélé qu'OpenAI imposait à ses employés démissionnaires des accords de non-dénigrement particulièrement stricts, sous peine de perdre leurs actions acquises — parfois des millions de dollars. En clair : parler pouvait coûter sa retraite. Face au tollé, Sam Altman a reconnu ne pas avoir été "au courant" de ces clauses. Une réponse qui a convaincu peu de monde.
Un phénomène qui dépasse OpenAI
Il serait trop simple de réduire ce problème à une seule entreprise. Google DeepMind, Meta AI et plusieurs autres acteurs majeurs ont connu des vagues similaires de départs ou de mises à l'écart de chercheurs critiques. Le pattern est toujours le même :
- Un chercheur soulève des risques liés à un modèle ou à un déploiement précipité
- Ses alertes sont minimisées en interne ou ignorées
- Il quitte l'entreprise — parfois contraint, parfois volontairement
- Il s'exprime publiquement après coup, souvent depuis un concurrent ou une structure indépendante
Ce cycle révèle une faille systémique : les incitations économiques dans l'industrie de l'IA récompensent la vitesse, pas la prudence. Les chercheurs en sécurité ne sont utiles que dans les limites où leurs conclusions ne freinent pas la croissance.
Les implications concrètes pour les utilisateurs et la société
Ces départs ne sont pas de simples remous d'entreprise. Ils ont des conséquences directes sur la qualité et la fiabilité des outils que des centaines de millions de personnes utilisent quotidiennement — de ChatGPT à Gemini en passant par Copilot.
Quand l'équipe chargée d'évaluer les risques d'un modèle est démantelée ou démoralisée, qui vérifie que GPT-5 ne produira pas de contenus dangereux à grande échelle ? Qui évalue les biais systématiques, les failles de manipulation, les usages détournés ? La réponse honnête est : de moins en moins de monde, avec de moins en moins d'indépendance.
Pour les professionnels qui intègrent ces outils dans leurs processus métier, la question n'est plus théorique. Elle touche à la gouvernance réelle des systèmes qu'ils déploient.
Ce que cela devrait changer — et ne changera probablement pas seul
Plusieurs pistes existent pour rompre ce cycle. La première est réglementaire : l'AI Act européen impose désormais des évaluations de risques indépendantes pour les modèles à haut impact. Mais son application reste partielle et ses moyens de contrôle, limités. La deuxième piste est sectorielle : des organisations comme l'AI Safety Institute britannique tentent de jouer ce rôle de vérificateur externe. Encore faut-il qu'elles aient accès aux modèles avant leur déploiement, et non après.
La troisième piste — la plus fragile — repose sur la pression publique. Chaque fois qu'un Jan Leike parle, chaque fois qu'une enquête expose des clauses de silence abusives, l'opinion se forme. Les régulateurs réagissent. Les investisseurs s'interrogent. Ce n'est pas suffisant, mais c'est réel.
Conclusion : la confiance ne se décrète pas
OpenAI répète à l'envi que la sécurité est sa priorité absolue. Mais une priorité qui pousse dehors ceux qui en ont fait leur métier n'est pas une priorité — c'est un argument marketing. La vraie mesure de l'engagement d'une entreprise envers la sécurité, c'est ce qu'elle fait quand la sécurité ralentit ses revenus.
Les chercheurs qui ont quitté OpenAI ne sont pas des traîtres ni des idéalistes naïfs. Ce sont des signaux d'alarme humains. La question est de savoir si nous choisissons de les entendre — ou si nous attendons, comme souvent, que l'événement que personne ne voulait voir arrive pour décider d'agir.
— Reservoir Live