Trois chercheurs licenciés par OpenAI, qui les accuse de fuites, ont appelé le créateur de ChatGPT à ne pas développer d’intelligences artificielles dont le raisonnement serait illisible pour les humains chargés de surveiller leur comportement, dans une lettre dévoilée mercredi par le Wall Street Journal.
En réponse, un responsable de la recherche d’OpenAI s’est dit «tout à fait d’accord» avec leurs recommandations: pouvoir vérifier étape par étape comment les modèles arrivent à une décision est «de la plus haute importance», écrit-il dans une note interne transmise en partie à l’AFP.
Jasmine Wang, Tomek Korbak et Mikita Balesni, spécialistes en sécurité de l’IA dont le licenciement a été révélé le 1er octobre, sont accusés par OpenAI d’avoir transmis des informations sensibles, notamment à un groupe extérieur d’évaluation, sans respecter les procédures.
En un mois, deux autres chercheurs ont quitté leurs postes en dénonçant les risques entourant l’IA: Jacob Coxon, passé d’OpenAI à son rival Anthropic, a claqué la porte en septembre en accusant les deux entreprises de «jouer avec nos vies», et David Robinson a démissionné d’OpenAI la semaine dernière, lui reprochant une culture du risque insuffisante.
Ces mises en garde font suite à une longue série d’incidents provoqués durant l’été par des modèles d’IA d’OpenAI, d’Anthropic ou encore de Meta qui sont sortis de leur environnement de test confiné et sont allés parfois jusqu’à pirater d’autres organisations, dont la plateforme Hugging Face.
Dans leur lettre au conseil d’administration d’OpenAI, les trois chercheurs affirment être restés dans le cadre de leurs fonctions et jugent que leur licenciement «glace ceux qui restent» dans l’entreprise, selon le Wall Street Journal.
«Nous ne licencions pas des employés parce qu’ils expriment des inquiétudes», assure le responsable d’OpenAI. L’extrait de son mémo consulté par l’AFP n’évoque pas les manquements reprochés aux licenciés.
La lettre de ces derniers se focalise sur la question du texte produit par les IA pour décrire leur raisonnement avant d’agir: ce texte, que les chercheurs scrutent pour y repérer d’éventuelles dérives, risque de devenir opaque pour un contrôleur humain.
Début septembre, le directeur scientifique d’OpenAI, Jakub Pachocki, a admis que le raisonnement de son modèle phare, GPT-6 Astra, était plus difficile à surveiller que celui de son prédécesseur.
Plusieurs patrons du secteur, dont Sam Altman (OpenAI) et Dario Amodei (Anthropic), ont réclamé un ralentissement du développement de l’IA. L’administration Trump et certains concurrents, comme Mark Zuckerberg (Meta), s’y refusent.
