Face à la multiplication d’incidents de sécurité liés à l’intelligence artificielle (IA), les géants américains de la tech ont signé mardi à la Maison-Blanche un code de bonne conduite destiné à mieux appréhender les risques de cette technologie.
En voici les principaux éléments:
Un accord volontaire
Refusant de corseter le secteur de l’intelligence artificielle (IA) sur le plan national et international, le président américain Donald Trump a mis en avant une charte très succincte, qui tient sur une page, et contraignante uniquement «sur le plan moral».
«Avec le temps, il peut être pertinent de codifier ces étapes sous forme de lois ou de régulations», précise toutefois ce document signé par les grands patrons de l’IA, d’Elon Musk à Dario Amodei (Anthropic), en passant par Sundar Pichai (Google) et Jensen Huang (Nvidia).
Et ce, au moment où les appels à des lois contraignantes se font de plus en plus pressants, émanant aussi bien d’entreprises comme Anthropic et OpenAI, à l’origine de ChatGPT, de politiques, notamment dans le camp démocrate aux États-Unis, ou encore de gouvernements à travers le monde.
Risques cyber et chimiques
Les fournisseurs de modèles d’IA se sont engagés à mettre en place «quatre niveaux» de surveillance et le premier consiste en des «contrôles internes robustes», afin de s’assurer que ces outils respectent les instructions données par les développeurs, notamment en matière de «cybersécurité» et de «biosécurité».
L’objectif est ainsi de prévenir l’introduction, la propagation et la libération d’agents pathogènes ou de «dangers chimiques».
Les entreprises devront créer des équipes spécialisées en interne pour gérer ces contrôles et s’assurer que les modèles «n’exécutent pas d’attaques informatiques ou n’accèdent pas à des systèmes techniques» de façon imprévue.
OpenAI, Anthropic et Google ont récemment fait état de plusieurs incidents impliquant des dérapages de leurs IA. Dernièrement, des agents IA d’OpenAI, programmes capables d’effectuer des actions de façon autonome, se sont par exemple introduits de leur propre chef sur un site du système de santé de l’Australie et des plateformes du gouvernement américain.
Audit indépendant
Le code de bonne conduite prévoit également le recours à des évaluateurs «externes» pour mener des audits indépendants, afin de déterminer si les mesures mises en place par les entreprises fonctionnent.
Anthropic et OpenAI travaillent déjà avec de tels évaluateurs externes et elles ont toutes les deux annoncé ces dernières semaines un accès élargi aux sociétés d’audit extérieur pour l’évaluation de leurs modèles, notamment au moment de leur conception et pas seulement avant leur déploiement.
Anthropic a même assuré qu’elle ne garderait pas «de contrôle éditorial» sur les publications des résultats de ces évaluateurs indépendants, même si elles lui sont défavorables.
Des normes définies par les entreprises
La charte vise, enfin, à l’établissement d’un comité indépendant, avec des représentants des différentes entreprises au plus haut niveau hiérarchique, qui sera chargé de passer en revue les évaluations internes et externes des modèles d’IA et de veiller à la résolution d’éventuels problèmes.
Les entreprises s’engagent par ailleurs à se réunir «régulièrement pour établir des normes et des bonnes pratiques.»
Ce projet semble rejoindre celui qu’avaient commencé à mettre en place OpenAI, Anthropic et Google DeepMind.
Ces trois entreprises avaient indiqué mi-septembre travailler à la création d’un organe de supervision des risques liés à l’IA, à l’image de l’Autorité américaine de régulation de l’industrie financière (FINRA), instance d’auto-régulation du secteur financier.
Mais ce schéma a déjà été vivement critiqué par des entreprises d’IA concurrentes comme le Français Mistral et le Canadien Cohere, qui accusent les géants américains de vouloir définir leurs propres règles et protéger leur avantage compétitif.