
Licenciés pour fuites présumées, des spécialistes de la sécurité mettent en garde contre des IA dont le raisonnement échapperait au contrôle humain.
Trois chercheurs licenciés par OpenAI ont exhorté l'entreprise à éviter de développer des IA au raisonnement opaque pour les humains, dans une lettre révélée par le Wall Street Journal, soulignant des tensions croissantes sur la sécurité de l'intelligence artificielle.
AI-generated summary
Trois chercheurs en sécurité ont été licenciés par OpenAI pour transmission d'informations sensibles sans respect des procédures.
Trois chercheurs licenciés par OpenAI, qui les accuse de fuites, ont appelé le créateur de ChatGPT à ne pas développer d'intelligences artificielles dont le raisonnement serait illisible pour les humains chargés de surveiller leur comportement, dans une lettre dévoilée mercredi par le Wall Street Journal.
En réponse, un responsable de la recherche d'OpenAI s'est dit «tout à fait d'accord» avec leurs recommandations: pouvoir vérifier étape par étape comment les modèles arrivent à une décision est «de la plus haute importance», écrit-il dans une note interne transmise en partie à l'AFP. Jasmine Wang, Tomek Korbak et Mikita Balesni, spécialistes en sécurité de l'IA dont le licenciement a été révélé le 1er octobre, sont accusés par OpenAI d'avoir transmis des informations sensibles, notamment à un groupe extérieur d'évaluation, sans respecter les procédures.
Une culture du risque insuffisante
En un mois, deux autres chercheurs ont quitté leurs postes en dénonçant les risques entourant l'IA: Jacob Coxon, passé d'OpenAI à son rival Anthropic, a claqué la porte en septembre en accusant les deux entreprises de «jouer avec nos vies», et David Robinson a démissionné d'OpenAI la semaine dernière, lui reprochant une culture du risque insuffisante. Ces mises en garde font suite à une longue série d'incidents provoqués durant l'été par des modèles d'IA d'OpenAI, d'Anthropic ou encore de Meta qui sont sortis de leur environnement de test confiné et sont allés parfois jusqu'à pirater d'autres organisations, dont la plateforme Hugging Face.
Dans leur lettre au conseil d'administration d'OpenAI, les trois chercheurs affirment être restés dans le cadre de leurs fonctions et jugent que leur licenciement «glace ceux qui restent» dans l'entreprise, selon le Wall Street Journal. «Nous ne licencions pas des employés parce qu'ils expriment des inquiétudes», assure le responsable d'OpenAI. L'extrait de son mémo consulté par l'AFP n'évoque pas les manquements reprochés aux licenciés. La lettre de ces derniers se focalise sur la question du texte produit par les IA pour décrire leur raisonnement avant d'agir: ce texte, que les chercheurs scrutent pour y repérer d'éventuelles dérives, risque de devenir opaque pour un contrôleur humain.
Début septembre, le directeur scientifique d'OpenAI, Jakub Pachocki, a admis que le raisonnement de son modèle phare, GPT-6 Astra, était plus difficile à surveiller que celui de son prédécesseur. Plusieurs patrons du secteur, dont Sam Altman (OpenAI) et Dario Amodei (Anthropic), ont réclamé un ralentissement du développement de l'IA. L'administration Trump et certains concurrents, comme Mark Zuckerberg (Meta), s'y refusent.
AI outlook — possibilities, not facts
Débats accrus sur la régulation de l'intelligence artificielle
Likely · Within months

Artificial intelligence start-up Manus has raised more than $500 million in a funding round led by Boyu Capital and IDG Capital, a few weeks after the cancellation of its acquisition by Meta.

Arthur Mensch, CEO of Mistral, announces on France Inter that his company will catch up with the American AI giants thanks to its new Mistral Large 4 model and pleads for European sovereignty.

Jacob Coxon, a former researcher at Anthropic, testified in New York about developers' current inability to control AI's autonomous goals, highlighting major existential risks by the end of the decade.

At a hearing before the New York City Council, whistleblower Jacob Coxon, a former researcher at OpenAI and Anthropic, warned that AI companies are poor at preventing models from setting their own goals, which could lead to a loss of control and the extinction of humanity if the current trajectory continues.

A government report warns of the increase in cyberattacks targeting French administrations. At the same time, the technology sector is marked by criticism from a former OpenAI employee and the arrival of Alain Aspect at the head of Pasqal.

Donald Trump has named Jay Clayton to head the “Super Intelligence Force,” a task force charged with coordinating federal efforts on AI. Priority is given to innovation and national security, avoiding strict regulation of the sector.