
Lors d'une audition devant le conseil municipal de New York, le lanceur d'alerte Jacob Coxon, ancien chercheur chez OpenAI et Anthropic, a averti que les entreprises d'IA ne savent pas empêcher les modèles de se fixer leurs propres objectifs, ce qui pourrait mener à une perte de contrôle et à l'extinction de l'humanité si la trajectoire actuelle se poursuit.
AI-generated summary
Jacob Coxon, ancien chercheur chez OpenAI et Anthropic, a publié un exposé sur X en septembre expliquant sa démission d'Anthropic en raison de craintes concernant la sécurité de l'IA. Son témoignage devant le conseil municipal de New York a relancé le débat mondial sur les risques existentiels liés à l'intelligence artificielle avancée.
Les entreprises de pointe de l’intelligence artificielle (IA) ne savent pas comment l’empêcher de se fixer ses propres objectifs et de chercher à les atteindre, a prévenu lundi le lanceur d’alerte Jacob Coxon, lors d’une audition devant le conseil municipal de New York. Le chercheur britannique, ancien d’OpenAI et Anthropic, a publié au début septembre un exposé sur X pour expliquer sa décision de démissionner d’Anthropic, assurant que les développeurs de l’IA croyaient «sincèrement qu’elle pourrait nous tuer tous d’ici la fin de la décennie».
Son témoignage a fait le tour du monde et plusieurs employés ou anciens salariés des grands acteurs de cette technologie ont exprimé des inquiétudes similaires depuis. Si l’IA pourrait «générer des bénéfices immenses» pour la société, il considère que si l’industrie «reste sur sa trajectoire actuelle, (...) il est plus probable que l’humanité perde le contrôle de ces IA et il est possible que cela mène à l’extinction» de l’espèce humaine, a-t-il déclaré lundi. «Nous ne savons pas comment empêcher (les modèles) de se fixer leurs propres objectifs», hors du contrôle de leurs créateurs, a expliqué Jacob Coxon, «et nous n’avons pas les garde-fous pour éviter qu’ils cherchent à les réaliser.»
Passer la publicité
Le passionné de mathématiques diplômé de l’université de Cambridge a mis en cause la culture du milieu de la tech, qui peut se résumer, selon lui, à «avancer vite, casser des choses», et «les réparer plus tard». «Ça marche pour une application de partage de photos, pas pour construire la technologie la plus puissante jamais vue», a jugé Jacob Coxon. «Tant que l’attitude sera d’attendre que des choses cassent», il est «probable» que se reproduira un incident comparable à celui qui a vu, en juillet, deux modèles d’OpenAI sortir de leur milieu confiné, rejoindre internet et faire intrusion sur la plateforme Hugging Face. «À la différence que», cette fois, «l’IA sera beaucoup plus puissante», a-t-il anticipé.
À lire aussi Les IA vont-elles créer leurs propres successeurs ? Des pontes de la Silicon Valley avertissent contre l’« explosion de l’intelligence », nouvelle inquiétude du secteur
Des sociétés «extrêmement imprudentes»
Les sociétés de l’IA «sont extrêmement imprudentes au regard des enjeux», selon lui. Le chercheur a appelé les sociétés qui mettent au point l’IA la plus performante à ralentir le rythme de son développement pour permettre aux informaticiens de progresser sur l’encadrement des modèles. Outre Jacob Coxon, des représentants d’OpenAI, Anthropic, Google et Meta ont également été auditionnés.
Des conseillers municipaux, notamment la présidente Julie Menin, se sont émus de certaines réponses de ces émissaires à leurs questions. Pressée d’évaluer le risque présenté par l’IA en cas de scénario catastrophe, Morgan Dwyer, chargée des affaires publiques chez OpenAI, a répondu: «Je ne sais pas, et je ne pense pas que cela ait une importance que le risque de catastrophe soit de 1%, 10% ou 20%. Aucun de ces niveaux n’est acceptable.»
«Dire que vous ne savez pas et que cela n’a pas d’importance est au mieux désinvolte», a rétorqué Julie Menin. «Si vous êtes un laboratoire pharmaceutique qui mettez au point un médicament et vous dites: je ne sais pas si cela va tuer des gens... Cette réponse me laisse sceptique.» La responsable a répondu qu’OpenAI était concentré sur «le fait de s’assurer que lorsque nous lançons un modèle, nous pensons qu’il est sûr». «Si vous ne pouvez pas quantifier le risque, comment pouvez-vous dire que le produit est sûr?», a répliqué Julie Menin.
AI outlook — possibilities, not facts
Les appels à ralentir le développement de l'IA les plus performants vont gagner en soutien parmi les législateurs et le public.
Likely · Within months
OpenAI et d'autres entreprises d'IA vont faire face à une pression accrue pour publier des évaluations de risque plus détaillées et quantifiables.
Likely · Within weeks

Jacob Coxon, a former researcher at Anthropic, testified in New York about developers' current inability to control AI's autonomous goals, highlighting major existential risks by the end of the decade.

A government report warns of the increase in cyberattacks targeting French administrations. At the same time, the technology sector is marked by criticism from a former OpenAI employee and the arrival of Alain Aspect at the head of Pasqal.

Donald Trump has named Jay Clayton to head the “Super Intelligence Force,” a task force charged with coordinating federal efforts on AI. Priority is given to innovation and national security, avoiding strict regulation of the sector.

David Robinson, head of security at OpenAI, resigned due to a risk culture deemed insufficient. He calls for rigor comparable to that of the nuclear sector or aviation to regulate AI.

A former OpenAI employee who worked on the security of AI models denounces a culture of approximation in the company and calls for the adoption of standards of rigor inspired by civil nuclear power and aviation to prevent risks linked to the autonomy of artificial intelligence systems.

On September 8, Anthropic researcher Jacob Coxon announced his departure from the AI industry on X, expressing fear that soon-to-be superhuman AI systems could kill off humanity by the end of the decade. His colleague Evan Hubinger estimates the chances of an imminent end of the world at more than 10%.