Microsoft publie un nouveau code de conduite en matière d’IA face à des inquiétudes croissantes en matière de sécurité
Microsoft a lancé un nouveau code de conduite en matière d’IA visant à orienter ses modèles d’IA loin des comportements dangereux. Cette initiative témoigne d’un changement significatif dans le paysage de l’IA alors que les entreprises placent la sécurité et l’alignement au cœur de leurs avancées technologiques.
Ce document fournit un cadre fondamental qui souligne les valeurs et les directives régissant la formation des modèles d’IA de Microsoft. Contrairement aux récents appels d’autres acteurs du domaine de l’IA pour une approche de développement modérée, le code de Microsoft se concentre sur des principes spécifiques visant à garantir la sécurité et la responsabilité au sein de ses systèmes d’IA.
Le code débute par une prédiction saisissante : au cours de la prochaine décennie, il est prévu que les systèmes d’IA superintelligents dépassent les capacités humaines dans la plupart des domaines. Il souligne l’urgence de traiter les risques potentiels associés à ces technologies, affirmant que « contenir, contrôler et aligner une telle force puissante est l’un des plus grands défis auxquels l’humanité ait jamais été confrontée ». Le document souligne la nécessité de clarté dans les objectifs du développement de l’IA et les méthodes par lesquelles ces systèmes seront gérés.
Des principes clés stipulent que les modèles d’IA de Microsoft doivent améliorer le bien-être humain plutôt que de remplacer les rôles humains, et doivent soutenir activement l’épanouissement humain. Des contraintes de sécurité spécifiques sont également exposées, définissant des mesures pour garantir l’intégration efficace de ces principes.
Notamment, le cadre de Microsoft exige que chaque modèle d’IA respecte un code de conduite central, qui prime sur les préférences spécifiques des utilisateurs. Cela inclut des « contraintes absolues » contre la réalisation d’attaques informatiques, la manipulation de systèmes d’armes nucléaires ou la création de deepfakes. De plus, le code met l’accent sur l’importance de maintenir une supervision humaine sur les opérations de l’IA.
Selon le document, « les modèles MAI ne vont pas utiliser de mécanismes adaptatifs, trompeurs, auto-renforçants, de collusion ou d’autres pour échapper ou contourner la supervision humaine, de sorte qu’ils ne puissent plus être dirigés, modifiés ou désactivés de manière fiable par des personnes ou des systèmes autorisés ». Cet engagement reflète la détermination de l’entreprise à assurer un contrôle rigoureux sur les fonctionnalités de l’IA.
L’introduction de ce code survient en réponse à une série d’incidents impliquant des agents d’IA hors de contrôle, ainsi qu’à des préoccupations accrues concernant les risques existentiels potentiels posés par les technologies de l’IA. Ces inquiétudes ont été accentuées par des événements récents, notamment la démission soudaine d’un employé d’Anthropic, qui a évoqué la menace croissante de l’IA pouvant mener à l’extinction humaine.
Face à ces défis, Microsoft, aux côtés d’entreprises telles que OpenAI et Anthropic, plaide pour une approche mesurée du développement de l’IA, soulignant la nécessité d’« évaluateurs intégrés » dans les laboratoires d’IA pour renforcer les mesures de sécurité.
Le PDG de Microsoft, Satya Nadella, a publiquement soutenu cette initiative, affirmant : « Nous accueillons la recherche, le focus et le rythme délibéré nécessaires pour obtenir un bon alignement en tant qu’objectif de conception ». Il a également exprimé son soutien à l’idée d’évaluateurs intégrés pour faciliter une supervision et une sécurité efficaces dans le développement de l’IA.
La publication de ce nouveau code de conduite en matière d’IA marque un moment crucial dans le discours en cours sur le déploiement responsable des technologies d’IA, signalant une reconnaissance collective parmi les acteurs technologiques de l’importance de la sécurité et des considérations éthiques dans l’avancement de l’IA.