Ancien chercheur d’OpenAI et Anthropic, il démissionne et accuse les géants de l’IA de « jouer avec nos vies » : décryptage du témoignage de Jacob Coxon
Jacob Coxon, chercheur en IA passé par OpenAI puis Anthropic, a publié sur X une série de tweets accusant les deux laboratoires de jouer avec l’avenir de l’humanité.
« J’ai démissionné d’Anthropic aujourd’hui. » Voici comment débute la série de tweets qui, en quelques heures, a dépassé les dizaines de millions de vues.
Le témoignage, publié dans la nuit du 8 au 9 septembre 2026, est signé Jacob Coxon, chercheur en pretraining, c’est-à-dire l’entraînement initial des grands modèles de langage (LLM) sur d’immenses volumes de données.
Passé par OpenAI puis par Anthropic, le chercheur annonce son départ et pose son constat. Selon lui, aucune des deux entreprises n’agit de façon responsable et toutes deux fonceraient vers une « superintelligence auto-améliorante » en prenant des risques existentiels.
Le pretraining est un poste d’observation privilégié : ce sont ces chercheurs qui façonnent les capacités brutes des modèles, avant même que les équipes de sécurité n’interviennent.
Le témoignage de Coxon prend donc un poids particulier, d’autant plus qu’il s’ajoute à celui de Mrinank Sharma, un chercheur de l’équipe sécurité d’Anthropic parti en février 2026 en évoquant un « monde en péril ».

Et votre vie numérique devient sereine
Bitdefender Premium Security est une solution de cybersécurité européenne qui vous protège automatiquement contre les pirates et toutes les menaces du web. Profitez de vos activités en ligne en toute tranquillité
Le message général qui se dégage du thread n’est pas un appel à l’arrêt immédiat de l’IA, mais une mise en garde sur la dynamique de course entre laboratoires, et un appel à ses anciens collègues à s’interroger, individuellement, sur leur participation à cette dynamique.
I resigned from Anthropic today. I spent the last three years doing pretraining research at both OpenAI and Anthropic. Neither company is acting responsibly. They are racing straight to self-improving superintelligence and gambling with our lives. More thoughts below.
— Jacob Coxon (@hilbertspaess) September 9, 2026
Ce contenu est bloqué car vous n’avez pas accepté les cookies et autres traceurs. Ce contenu est fourni par Twitter.
Pour pouvoir le visualiser, vous devez accepter l’usage étant opéré par Twitter avec vos données qui pourront être utilisées pour les finalités suivantes : vous permettre de visualiser et de partager des contenus avec des médias sociaux, favoriser le développement et l’amélioration des produits d’Humanoid et de ses partenaires, vous afficher des publicités personnalisées par rapport à votre profil et activité, vous définir un profil publicitaire personnalisé, mesurer la performance des publicités et du contenu de ce site et mesurer l’audience de ce site (en savoir plus)
En cliquant sur « J’accepte tout », vous consentez aux finalités susmentionnées pour l’ensemble des cookies et autres traceurs déposés par Humanoid et .
Vous gardez la possibilité de retirer votre consentement à tout moment. Pour plus d’informations, nous vous invitons à prendre connaissance de notre Politique cookies.
Alignement, course et « endgame », ce que dit le thread
Jacob Coxon développe son propos en plusieurs temps. Il affirme d’abord que les systèmes à venir seront « surhumains », capables de pirater n’importe quel système ou de bouleverser des pans entiers de la recherche scientifique du jour au lendemain, une affirmation qui reste, à ce stade, une projection basée sur la trajectoire observée et non un fait établi.
Puis, il introduit une distinction entre les deux entreprises qu’il a connues de l’intérieur. Chez OpenAI, écrit-il, beaucoup de salariés n’auraient pas pleinement intégré l’ampleur des enjeux civilisationnels. Chez Anthropic en revanche, ces enjeux seraient bien compris en interne, mais l’entreprise se sentirait prise au piège d’une logique de course : ne pas ralentir, de peur qu’un concurrent moins prudent n’arrive le premier à des systèmes surpuissants.
Une logique que le chercheur qualifie de « pari présomptueux » : accepter cette course et entrer dans l’« endgame », la phase finale, celle où tout se joue avant qu’il ne soit plus possible de revenir en arrière.
Le terme technique central de son propos est l’alignement, comprenez l’ensemble des méthodes visant à garantir qu’un système d’IA agisse conformément aux intentions humaines, même lorsqu’il devient plus capable que ses concepteurs.
Jacob Coxon s’inquiète justement de voir les laboratoires envisager de lancer des cycles d’apprentissage par renforcement à très grande échelle sur des systèmes dont on ne comprendrait pas encore correctement le « raisonnement » interne, une alerte d’ailleurs évoquée quelques jours plus tôt par le chef scientifique d’OpenAI.
Marketing de la peur ou lancement d’alerte crédible ?
Petite lueur d’optimisme, Jacob Coxon salue les signaux d’alarme récents, comme la cyberattaque menée cet été par des agents IA d’OpenAI contre l’infrastructure de Hugging Face, qui ont pu relancer les tentatives de coordination entre laboratoires américains. Cet épisode a notamment poussé plusieurs milliers de salariés de labs concurrents à signer une lettre ouverte réclamant un « ralentissement maîtrisé » du développement de l’IA.
Dans son thread, Jacob Coxon anticipe également l’objection selon laquelle son témoignage et plus généralement ce type de signaux d’alarme relèveraient d’un « coup marketing ».
Le secteur de l’IA est régulièrement pointé du doigt pour instrumentaliser le discours sur les risques existentiels, que ce soit pour se distinguer commercialement ou pour orienter une régulation naissante en sa faveur.
Mais ce nouveau témoignage, provenant d’un salarié qui démissionne, donne du poids à ce type d’alerte aux yeux du public, et explique en partie l’ampleur de sa diffusion.
Toute l'actu tech en un clin d'œil
Ajoutez Numerama à votre écran d'accueil et restez connectés au futur !
Tout comprendre à La guerre de l’IA
- OpenAI dévoile GPT-6-Astra, le nouveau modèle flagship de ChatGPT
- ChatGPT ou Claude en panne ? Voici les meilleures alternatives en 2026
- C’est officiel, Nvidia rachète Hugging Face et met la main sur la plateforme de référence de l’IA
- Meta AI débarque sur Mac pour concurrencer ChatGPT et Claude (et on lui souhaite bon courage)
- Google dévoile Gemini 3.7 Flash et casse les prix… mais le modèle Pro est porté disparu
KioskNews shows a cleaned-up reading view extracted from the publisher’s page — the original always lives on their site, not ours.