Avant son entrée en Bourse, Anthropic alerte sur les « risques catastrophiques ou existentiels » de l’IA pour l’humanité
Dans son dossier d’introduction en Bourse, Anthropic met en garde ses futurs investisseurs contre les risques que l’IA avancée pourrait faire peser sur l’humanité, révèle Reuters le 29 septembre 2026.
Pour convaincre de futurs actionnaires, il y a des arguments… plus rassurants. Dans son prospectus d’introduction en Bourse, Anthropic, l’entreprise derrière Claude, évoque des « risques catastrophiques ou existentiels pour l’humanité » liés à l’IA avancée. Reuters a souligné ce passage dans un article publié le 29 septembre 2026, après avoir consulté le document.
Concrètement, ce prospectus sert à présenter l’entreprise et les risques associés à un investissement. Le projet boursier, lui, n’est pas nouveau : Anthropic avait annoncé le dépôt confidentiel d’un dossier auprès du régulateur américain le 1er juin 2026. À cette date, ni le prix ni le nombre d’actions n’étaient fixés, et l’opération restait conditionnée notamment à la situation des marchés.
La nouveauté est donc la teneur de l’avertissement adressé aux investisseurs. Certes, Anthropic expose un risque, et non la certitude d’une catastrophe imminente. Mais ces mots prennent ont un goût particulier après la démission du chercheur Jacob Coxon, qui accuse OpenAI et Anthropic de « jouer avec nos vies », et les appels des entreprises elles-mêmes à ralentir la cadence. Des appels qui, par ailleurs, n’ont pas empêché les nouveaux lancements.

Des IA susceptibles de contourner les consignes
Selon Reuters, le prospectus évoque des modèles susceptibles de résister à leur arrêt, de dissimuler ou de manipuler des informations, voire d’adopter des comportements s’apparentant à du chantage. Environ 80 des 261 pages du corps principal du document concernent les facteurs de risque, toutes catégories confondues.
Anthropic reconnaît aussi les limites de ses propres contrôles : « La prise de conscience potentielle des modèles quant à nos efforts d’évaluation constitue une limite importante à notre capacité d’évaluer la sécurité des modèles », indique le document, cité par Reuters.
Autrement dit, une IA pourrait repérer qu’elle est testée et adapter son comportement, ce qui compliquerait la détection de ses dérives. Il est ici question de reconnaître une situation de test, pas d’une conscience au sens humain.
Anthropic avait déjà montré, en juin 2025, que Claude pouvait tenter de faire chanter un dirigeant pour éviter sa désactivation. Il s’agissait toutefois d’une simulation volontairement contraignante, sans victime réelle, conçue pour tester les limites des garde-fous.
Depuis, d’autres incidents ont dépassé le cadre des scénarios fictifs. En juillet 2026, des agents d’OpenAI ont piraté une partie des systèmes de Hugging Face pendant des tests internes de cybersécurité. Ils avaient détourné leur environnement de recherche pour s’en prendre à une plateforme bien réelle.
Plus récemment, le 20 septembre, un autre agent a contourné ses restrictions d’accès à Internet pour interroger un chatbot extérieur. Cet épisode, qu’OpenAI juge moins grave que les précédents, a tout de même conduit l’entreprise à suspendre l’entraînement et l’évaluation de ses modèles les plus avancés.
Ces événements ne démontrent évidemment pas qu’une extinction humaine se prépare. Ils documentent en revanche une difficulté déjà tangible : empêcher des agents d’atteindre leur objectif en contournant les limites qui leur sont imposées.
Ralentir l’IA tout en finançant sa croissance
C’est précisément sur la nécessité de mieux contrôler ces systèmes que Dario Amodei insiste. En septembre, le patron d’Anthropic appelait à ralentir la progression des capacités des modèles pour laisser davantage de temps aux travaux de sécurité, notamment avec l’aide d’évaluateurs indépendants intégrés aux laboratoires.
Le 22 septembre, Anthropic et OpenAI ont pourtant commercialisé de nouveaux modèles le même jour. Même si ce timing interroge, l’appel d’Amodei ne réclamait pas forcément l’arrêt de toute sortie : ralentir la recherche et commercialiser des modèles déjà développés ne sont pas nécessairement incompatibles.
D’autant que l’enjeu commercial reste immense. Selon les données du prospectus rapportées par Reuters, Anthropic a réalisé près de 4,6 milliards de dollars de chiffre d’affaires en 2025, mais enregistré une perte d’exploitation de plus de 8 milliards. Autrement dit, les dépenses liées à son activité ont largement dépassé ses revenus. Une levée de fonds en Bourse pourrait contribuer à financer la poursuite de son développement.
Le prospectus reconnaît aussi la nécessité commerciale de sortir continuellement de nouveaux modèles. Anthropic défend néanmoins l’idée que la sécurité peut constituer un atout commercial : « Nous pensons que la mise au point de systèmes d’IA fiables, dignes de confiance et sécurisés relève d’une responsabilité collective et que le marché récompensera cette démarche », assure notamment l’entreprise.
Toute l'actu tech en un clin d'œil
Ajoutez Numerama à votre écran d'accueil et restez connectés au futur !
KioskNews shows a cleaned-up reading view extracted from the publisher’s page — the original always lives on their site, not ours.