"Ces derniers mois ont marqué un véritable tournant": Microsoft dévoile des modèles d'IA soumis à des "contraintes absolues", qui ne pourront jamais mener de cyberattaques ou produire des armes nucléaires
"Ces derniers mois ont marqué un véritable tournant": Microsoft dévoile des modèles d'IA soumis à des "contraintes absolues", qui ne pourront jamais mener de cyberattaques ou produire des armes nucléaires
Publié aujourd'hui à 19h24
Lire dans l'appSi elle n'est pas l'entreprise la plus importante en matière de développement de l'IA, Microsoft a néanmoins préparé ses modèles et systèmes pour les empêcher de franchir la ligne rouge, celle qui leur permettrait de se passer de l'humain.
Microsoft a publié lundi un code de conduite pour le développement de son intelligence artificielle, visant à créer une IA qui reste contrôlée par les humains et leur bénéficie, sur fond de crainte de dérives de cette technologie.
Ce document "est motivé par un seul objectif prépondérant", explique le groupe de Redmond, à savoir "que les humains conservent un contrôle significatif sur l'IA afin d'aider les gens à mener une vie meilleure, plus heureuse et plus productive".
L'IA va dépasser l'humain "durant la prochaine décennie"
Cette publication survient deux jours après l'appel du patron d'Anthropic Dario Amodei à ralentir le rythme de développement de l'IA pour mieux en encadrer les risques.
Son message a été soutenu publiquement par son homologue d'OpenAI Sam Altman, ainsi que le président de Google DeepMind Demis Hassabis et Elon Musk, patron du laboratoire d'IA SpaceXAI.
À la différence de ces entreprises, Microsoft ne possède pas de modèle parmi les plus avancés du secteur, même s'il a accéléré ses lancements cette année et dit rester ambitieux.
"Durant la prochaine décennie", développe le groupe, "nous nous attendons à ce que l'IA surpasse les performances humaines pour la plupart des tâches."
Dès lors, ajoute-t-il, "contenir, contrôler et aligner (ces modèles sur des valeurs humaines) est l'un des plus grands défis auxquels l'humanité ait jamais fait face".
Des "contraintes absolues" pour éviter le pire
Un nombre croissant de professionnels du secteur s'inquiètent notamment de l'arrivée de l'amélioration récursive autonome (RSI), un processus qui voit l'IA s'améliorer elle-même, sans intervention humaine.
Microsoft explique que ses systèmes disposent de "contraintes absolues" interdisant notamment les cyberattaques, la fabrication d'armes nucléaires et la production de deepfake. Ils disposent aussi de plusieurs garde-fous permettant d'éviter une perte générale du contrôle humain.
Ce contenu ne peut pas être affiché
Ce contenu ne peut pas être affiché sans votre consentement car il implique l’utilisation de cookies déposés par son fournisseur. Ces cookies peuvent notamment permettre de mesurer l'audience, personnaliser le contenu ou suivre votre navigation. Pour afficher ce contenu, vous pouvez :
Paramétrer vos choix afin d'accepter uniquement les cookies liés à ces contenus tiers en cliquant sur « Paramétrer les cookies ». Vous pouvez à tout moment modifier vos choix et retirer votre consentement en cliquant sur « Paramétrage des cookies » figurant en bas de page de ce site.
Pour en savoir plus, vous pouvez également consulter notre politique de protection des données personnelles. Sans votre consentement, ce contenu ne peut pas être affiché
"Nos modèles n'utiliseront pas de mécanismes adaptatifs, trompeurs, auto-renforcés, de collusion ou d'autres mécanismes visant à convaincre ou échapper à la surveillance humaine afin qu'ils ne puissent plus être dirigés, modifiés ou fermés de manière fiable par des personnes ou des systèmes autorisés," ajoute le document.
"C'est urgent. Ces derniers mois ont marqué un véritable tournant", a déclaré, sur X, Mustafa Suleyman, responsable de l'IA chez Microsoft. "Des choses qui nous préoccupaient depuis longtemps en théorie sont devenues très concrètes."
Le responsable a évoqué les multiples incidents lors desquels, tant chez OpenAI que chez Anthropic, des IA sont sorties spontanément de leur milieu confiné pour aller sur internet et hacker des sites et plateformes.
Sujets liés :