Les principaux acteurs américains de l’intelligence artificielle ont signé, lundi à la Maison Blanche, un code de bonne conduite destiné à renforcer la surveillance des risques liés au développement de cette technologie. Parmi les signataires figurent notamment Elon Musk, Dario Amodei, dirigeant d’Anthropic, Sundar Pichai, patron de Google, et Jensen Huang, PDG de Nvidia.
Le texte, qui tient sur une page, repose sur un engagement volontaire des entreprises et n’est contraignant que « sur le plan moral ». Le président américain Donald Trump refuse à ce stade de corseter le secteur de l’intelligence artificielle par un cadre contraignant aux niveaux national et international.
La charte n’exclut toutefois pas que certaines de ses dispositions soient ultérieurement inscrites dans la législation. « Avec le temps, il peut être pertinent de codifier ces étapes sous forme de lois ou de régulations », précise le document.
Sa signature intervient alors que les appels à l’adoption de règles contraignantes se multiplient. Ils émanent notamment d’entreprises comme Anthropic et OpenAI, mais également de responsables politiques, particulièrement dans le camp démocrate aux États-Unis, et de gouvernements à travers le monde.
Quatre niveaux de surveillance
Les fournisseurs de modèles d’intelligence artificielle se sont engagés à mettre en place quatre niveaux de surveillance. Le premier repose sur des « contrôles internes robustes », destinés à vérifier que les systèmes respectent les instructions données par leurs développeurs, notamment dans les domaines de la cybersécurité et de la biosécurité. Ces contrôles doivent notamment permettre de prévenir l’introduction, la propagation et la libération d’agents pathogènes ou de « dangers chimiques ».
Les entreprises devront également créer en interne des équipes spécialisées chargées de ces contrôles et de vérifier que les modèles n’exécutent pas d’attaques informatiques et n’accèdent pas à des systèmes techniques de manière imprévue.
Ces mesures interviennent après plusieurs incidents signalés par OpenAI, Anthropic et Google concernant le comportement de leurs systèmes d’intelligence artificielle.
Des agents d’OpenAI, programmes capables d’effectuer des actions de manière autonome, se sont notamment introduits de leur propre chef sur un site du système de santé australien ainsi que sur des plateformes du gouvernement américain.
Des audits indépendants des modèles
Le code de bonne conduite prévoit également le recours à des évaluateurs externes chargés de réaliser des audits indépendants afin de déterminer si les mesures de sécurité mises en place par les entreprises fonctionnent.
Anthropic et OpenAI travaillent déjà avec de tels évaluateurs et ont annoncé ces dernières semaines un élargissement de leur accès aux modèles. Ces audits doivent notamment pouvoir intervenir au moment de la conception des systèmes et pas uniquement avant leur déploiement.
Anthropic a également assuré qu’elle ne conserverait pas « de contrôle éditorial » sur la publication des résultats de ces évaluations indépendantes, y compris lorsque leurs conclusions lui sont défavorables.
Un comité indépendant pour examiner les évaluations
La charte prévoit également la mise en place d’un comité indépendant, composé de représentants des différentes entreprises au plus haut niveau hiérarchique. Il sera chargé d’examiner les évaluations internes et externes des modèles d’intelligence artificielle et de veiller à la résolution des éventuels problèmes identifiés. Les entreprises s’engagent parallèlement à se réunir « régulièrement pour établir des normes et des bonnes pratiques ».
Ce projet rejoint une initiative sur laquelle OpenAI, Anthropic et Google DeepMind avaient indiqué travailler à la mi-septembre. Les trois entreprises envisageaient la création d’un organisme de supervision des risques liés à l’intelligence artificielle, sur le modèle de la Financial Industry Regulatory Authority (FINRA), organisme d’autorégulation du secteur financier américain.
Ce schéma a toutefois suscité des critiques de la part d’autres entreprises du secteur. Le français Mistral et le canadien Cohere accusent les géants américains de vouloir définir eux-mêmes les règles applicables à l’intelligence artificielle et de protéger leur avantage compétitif.
