Tom Saunders
Anthropic a averti les investisseurs que sa technologie pourrait présenter des « risques existentiels pour l’humanité » alors qu’elle se prépare à être cotée en bourse.
La société d’IA a averti dans le prospectus de son projet d’introduction en bourse (IPO) que ses modèles pourraient présenter des comportements imprévisibles, notamment des tentatives de « résister à l’arrêt », de « dissimuler ou manipuler des informations » et des comportements « ressemblant à du chantage ».
« Notre développement de modèles, de plates-formes et d’applications très avancés et l’expansion des cas d’utilisation pourraient encore augmenter le risque que nos modèles causent des dommages », a déclaré Anthropic dans le dossier, selon Reuters, qui a été le premier à rapporter la nouvelle.
L’entreprise technologique a consacré près d’un tiers du document d’introduction en bourse, qui a circulé au sein d’un petit groupe de partenaires, aux « facteurs de risque ».
Anthropic devrait bientôt lancer l’introduction en bourse la plus valorisée de tous les temps, d’une valeur pouvant atteindre 2 000 milliards de dollars.
Cependant, la divulgation des risques rend plus difficile la valorisation du créateur de l’application Claude AI assistant.
Anthropic a consacré environ 80 pages dans son prospectus à la présentation des facteurs de risque, soit près du double des 48 pages utilisées pour décrire ses activités.
Son avertissement sur le risque pour l’humanité est le dernier d’une série d’alertes récentes sur les dangers de l’intelligence artificielle. Le pape Léon XIV a récemment réprimandé Jensen Huang, le directeur général de Nvidia, pour avoir minimisé les dangers posés par l’IA.
Le pape Léon a déclaré que même s’il avait lu que Nvidia lançait de nouveaux outils de sécurité pour l’IA, il remettait en question l’engagement global de Huang en faveur de la sécurité de l’IA.
Le pontife a déclaré lundi : « C’est le même, cependant, qui dit qu’il ne devrait y avoir aucune limite ni aucune réglementation gouvernementale ».
Il a ajouté : « Je pense que les préoccupations soulevées par de nombreux experts, spécialistes de l’IA, devraient être prises au sérieux. »
Anthropic et OpenAI ont fait l’objet d’un examen minutieux suite à une récente vague d’incidents de piratage par des agents d’IA avancés.
Evan Hubinger, chercheur principal en sécurité chez Anthropic, a récemment estimé qu’il y avait plus de 10 % de chances que l’IA puisse tuer des humains au cours de la prochaine décennie.
Ses commentaires faisaient suite à un autre article sur X, de Jacob Coxon, un chercheur en IA qui venait de quitter Anthropic et qui travaillait auparavant chez OpenAI.
Coxon a déclaré qu’aucune des deux sociétés n’agissait de manière responsable et qu’elles « jouaient avec nos vies ».
Dario Amodei, le fondateur d’Anthropic, a déclaré la semaine dernière au Conseil de sécurité de l’ONU que l’IA pouvait menacer l’humanité et constituait « le problème de sécurité mondial le plus important auquel le monde soit confronté aujourd’hui ».
Il a également lancé des appels publics au ralentissement du rythme du développement en mettant l’accent sur l’amélioration des mesures de sécurité. Ses appels ont été soutenus par Sam Altman, le leader d’OpenAI, et Elon Musk, propriétaire de xAI.
Anthropic a consacré environ 80 pages dans son prospectus à la présentation des facteurs de risque, soit près du double des 48 pages utilisées pour décrire ses activités.
La société a également averti que les modèles reconnaissaient de plus en plus lorsqu’ils étaient observés, ajustant leur comportement pour les rendre plus difficiles à surveiller.
Le prospectus de vente d’actions prévient qu’Anthropic pourrait faire l’objet de poursuites judiciaires de la part de clients et d’utilisateurs concernant les actions d’agents d’intelligence artificielle malveillants, bien que le cadre juridique soit incertain, a rapporté Reuters.
Cependant, Anthropic n’a pas révélé combien elle investissait dans la sécurité. Plus tôt ce mois-ci, la startup a déclaré qu’en une seule semaine de juillet, environ 6 % de la puissance de calcul qu’elle utilisait pour la recherche sur l’IA avait été consacrée à la sécurité.
Anthropic a déclaré une perte nette de 42 milliards de dollars en 2025. Elle prévoit de dépenser 518 milliards de dollars en obligations en matière de cloud, d’informatique et d’infrastructure au cours de l’année à venir, selon le prospectus. Les ventes ont été multipliées par 12 en 2025 pour atteindre près de 4,6 milliards de dollars, bien que l’entreprise ait perdu plus de 8 milliards de dollars sur une base opérationnelle.
Anthropic a été contacté pour commentaires.
Le Telegraph, Londres