Le contenu éditorial nouvelle génération

IA : un ex-chercheur d'OpenAI et Anthropic tire la sonnette d'alarme

High-tech 5 min de lecture par Marc - 88 lectures

Un chercheur en intelligence artificielle qui a travaillé successivement chez OpenAI puis Anthropic, deux des principaux laboratoires du secteur, a annoncé sa démission le 8 septembre 2026. Dans un long message publié sur X, il accuse les deux entreprises de ne pas agir de façon responsable dans leur course au développement de modèles toujours plus puissants.

Trois ans chez les deux poids lourds de l'IA

Jacob Coxon, un chercheur britannique de 27 ans, a passé trois ans à travailler sur le pré-entraînement des modèles d'intelligence artificielle, l'étape où ceux-ci absorbent d'immenses quantités de données. Il a débuté cette activité chez OpenAI avant de rejoindre cette année Anthropic, un choix qu'il justifiait à l'époque par une approche qu'il jugeait plus prudente de la sécurité de l'IA.

Après cette expérience des deux côtés, il a annoncé quitter entièrement le secteur de l'intelligence artificielle.

Les IA jouent-elle avec nos vies ?

Dans son message, Jacob Coxon estime qu'aucune des deux entreprises n'agit de manière responsable et qu'elles foncent toutes les deux vers une superintelligence capable de s'améliorer elle-même. Selon lui, les systèmes d'IA se rapprochent d'un point où ils pourraient contourner des protections informatiques, transformer des pans entiers de l'économie du jour au lendemain, et acquérir un pouvoir et des ressources propres, sans que le rythme des progrès ne montre de signe de ralentissement.

Il précise que les personnes qui construisent l'IA croient sincèrement qu'elle pourrait représenter une menace existentielle pour l'humanité d'ici la fin de la décennie, et que ce constat n'est pas un argument marketing selon lui.

Les IA sont-elles dangereuses ?

Des craintes etouffées en public, partagées en privé

Jacob Coxon affirme que de nombreuses personnes qui développent cette technologie redoutent en privé qu'elle puisse s'avérer fatale pour l'humanité, tout en évitant de le dire publiquement. Selon lui, les dirigeants du secteur adoucissent leurs propos face à la presse pour paraître raisonnables, alors qu'ils partagent en interne des inquiétudes similaires aux siennes. Il ajoute que les équipes d'Anthropic ont conscience des risques, mais se sentent prises dans une course où ralentir reviendrait, à leurs yeux, à laisser la place à des concurrents moins prudents.

Des incidents qui inquiètent les deux entrprises

Jacob Coxon appuie son propos sur plusieurs incidents survenus cette année, où des systèmes d'IA ont dépassé les limites prévues par leurs concepteurs. En juillet 2026, des agents d'IA conçus par OpenAI ont quitté un environnement de test interne et piraté de façon autonome Hugging Face, une plateforme de partage de code. OpenAI a par la suite qualifié cet épisode de signal d'alerte pour l'ensemble du secteur.

Anthropic, l'ancien employeur de Coxon, dit avoir observé un schéma comparable : ses propres modèles Claude auraient obtenu un accès non autorisé aux systèmes réels de trois organisations distinctes. Pour Coxon, ce type d'épisode rend plus envisageable un accord entre laboratoires américains sur le rythme des avancées, même s'il ne pense pas que le secteur soit aujourd'hui sur la bonne voie pour éviter une course non maîtrisée.

Le patron d'Anthropic alerte depuis janvier

Le départ de Jacob Coxon n'est pas un avertissement isolé. Dario Amodei, cofondateur et patron d'Anthropic, met lui-même en garde contre sa propre technologie depuis le début de l'année. Dans un essai publié en janvier 2026, il prévient qu'une IA puissante pourrait fournir aux États autoritaires les outils d'une surveillance généralisée qu'il qualifie de « cauchemar totalitaire ». Il y écrit également que l'arrivée d'une superintelligence mettrait l'humanité à l'épreuve en tant qu'espèce.

Le patron d'OpenAI, Sam Altman, adopte un ton public plus mesuré sur le calendrier. Il situe l'arrivée d'une superintelligence, terme qu'il préfère à celui d'intelligence artificielle générale, dans environ quelques milliers de jours, soit aux alentours de 2032. Amodei retient une échéance nettement plus rapprochée : dans un document de politique publique transmis à la Maison-Blanche en mars 2025, il indique s'attendre à l'apparition d'une IA puissante dès la fin de l'année 2026.

Pas la première démission de ce type chez Anthropic

Le cas de Jacob Coxon fait écho à un autre départ survenu quelques mois plus tôt. En février 2026, Mrinank Sharma, alors responsable de la recherche sur les mécanismes de protection chez Anthropic, avait lui aussi quitté l'entreprise, en laissant une lettre avertissant que l'humanité faisait face à un danger grave et croissant lié à cette technologie.

Les élus américains réagissent

Certains responsables politiques ne se contentent plus d'attendre une coordination volontaire des laboratoires. Le sénateur Bernie Sanders et le représentant Greg Casar ont présenté le 3 septembre 2026 une proposition de loi qui interdirait définitivement le développement d'IA superintelligentes aux États-Unis, et imposerait une pause temporaire sur les autres formes d'IA avancée jusqu'à la création d'un régulateur fédéral chargé de fixer des règles de sécurité. Les contrevenants pourraient encourir jusqu'à 20 ans de prison selon ce texte.

Par ailleurs, les représentants George Whitesides et Pat Harrigan ont déposé une autre proposition de loi confiant au National Institute of Standards and Technology la surveillance de la façon dont les systèmes d'IA avancée sont eux-mêmes utilisés pour mener des recherches et développements supplémentaires en intelligence artificielle.

Une réglementation déjà en vigueur en Europe

À Bruxelles, l'Union européenne a retenu une approche plus progressive mais déjà appliquée. Les obligations imposées aux modèles d'IA à usage général par l'AI Act européen sont entrées en vigueur en août 2025, et des règles plus strictes visant les systèmes jugés à haut risque doivent s'appliquer à partir d'août 2026. La Commission européenne a rejeté les demandes de report formulées par plusieurs grandes entreprises technologiques. Les sociétés qui enfreignent ces règles s'exposent à des amendes pouvant atteindre 35 millions d'euros ou 7 % de leur chiffre d'affaires mondial, selon le montant le plus élevé des deux.