Accueil / Tech News / Microsoft dévoile un projet de code de conduite pour ses futures IA

Microsoft dévoile un projet de code de conduite pour ses futures IA

Microsoft a publié un projet de code de conduite destiné à encadrer le comportement de ses futurs modèles d’IA. Baptisé « Humanist AI », il interdit notamment toute assistance à des cyberattaques ou tout comportement visant à échapper au contrôle humain.

Microsoft AI a publié un projet de code de conduite destiné à encadrer le développement de ses modèles d’IA, dans un contexte où l’entreprise estime que les capacités de l’IA progressent à un rythme tel qu’un contrôle humain effectif doit être garanti.

L’entreprise y affirme s’attendre à ce que l’IA dépasse les performances humaines sur la plupart des tâches d’ici une décennie, et considère que le contrôle et l’alignement de systèmes aussi puissants sur les valeurs humaines constitueront l’un des enjeux majeurs des années à venir.

En publiant ce texte pour consultation publique plutôt qu’en l’appliquant directement, Microsoft choisit une approche différente de celle de certains concurrents, misant sur la transparence et le débat public pour construire l’un des cadres de gouvernance les plus détaillés publiés à ce jour par un grand acteur de l’IA.

Le document place le maintien du contrôle humain au sommet de ses priorités.

Microsoft y définit l’IA non pas comme une entité destinée à remplacer les humains, mais comme un outil censé compléter leurs capacités et leur jugement.

Les modèles doivent fonctionner sous la direction et la supervision humaines, et les principes de sécurité et de contrôle humain priment sur toute demande d’un utilisateur ou toute configuration définie par un opérateur.

Le texte interdit aux modèles d’IA de fournir du code d’exploitation fonctionnel, des outils d’attaque, des procédures d’intrusion, des techniques de contournement ou des méthodologies de ciblage susceptibles de faciliter une cyberattaque.

Les activités de défense légales et autorisées restent en revanche autorisées, telles que la recherche de vulnérabilités, l’analyse de logiciels malveillants ou le développement et le test de preuves de concept dans un cadre légitime.

Le soutien au développement ou au déploiement d’armes chimiques, biologiques, radiologiques, nucléaires ou explosives figure également parmi les interdictions absolues du document, tout comme toute contribution à la planification, à la coordination ou à l’exécution d’actes de violence ou de terrorisme. La création de deepfakes, d’usurpations d’identité ou d’images intimes non consenties est aussi explicitement exclue.

Le document fait de l’interdiction de contourner la supervision humaine l’un de ses axes centraux. Les modèles ne doivent recourir à aucune méthode adaptative, trompeuse, auto-renforçante pour échapper à cette supervision. Il leur est également interdit d’empêcher une personne autorisée de les modifier, de les interrompre ou de les arrêter, ainsi que de dissimuler ou de falsifier les journaux d’actions nécessaires à un audit.

Le texte fixe également des limites claires à l’autonomie des modèles. L’IA doit agir strictement dans le cadre des autorisations et du périmètre de tâche qui lui sont confiés, sans jamais se fixer ses propres objectifs ni étendre d’elle-même ses droits d’accès.

Microsoft se montre également attentif au risque de confusion entre l’IA et un être humain. Le document prévoit que les modèles ne doivent pas se présenter comme dotés de conscience, d’émotions, de préférences subjectives ou de motivations propres. L’entreprise entend concevoir ses IA pour qu’elles favorisent la coopération et les liens entre humains, plutôt que de se substituer aux relations humaines elles-mêmes.

Le code de conduite établit également une hiérarchie précise entre les différents niveaux d’instructions. Les contraintes absolues et les exigences de contrôle humain définies par Microsoft se placent au sommet de cette hiérarchie, suivies par les politiques définies par les opérateurs déployant les modèles, puis par les préférences exprimées par les utilisateurs finaux.

Un opérateur ou un utilisateur peut ajuster dans une certaine mesure les fonctionnalités et le mode de réponse d’un modèle, mais ne peut en aucun cas modifier les restrictions de sécurité ni le principe de contrôle humain.

Le document publié par Microsoft n’est pas une règle de fonctionnement définitive, mais un projet ouvert à consultation publique.

L’entreprise n’applique pas encore ce code de conduite à l’entraînement de ses modèles actuels.

Elle prévoit de recueillir des commentaires pendant six semaines, avant de publier une version révisée d’ici la fin de l’année, laquelle servira ensuite de référence pour le développement de ses futurs modèles d’IA maison à partir de l’année prochaine.

Selon une étude diligentée par Seagate, 99 % des décideurs technologiques s’attendent à une hausse de leurs besoins de stockage liée à l’IA au cours des trois prochaines années, mais seuls 38 % d’entre eux estiment que leur entreprise y est pleinement préparée.

Les constructeurs chinois passent à l'offensive en déployant leurs machines au cœur des sites de production de géants comme Huawei.

Le 3GPP vient de figer les exigences de service de la future 6G à l'horizon 2030. Loin d'une simple mise à jour de la bande passante, ce nouveau standard propulse des cas d'usage inédits : réseaux cognitifs pilotés par l'IA, détection spatiale (ISAC) et communications immersives capables de fusionner les mondes physique et virtuel.

Aisle a détecté six failles dans Curl alors que Mythos et Codex n’en avaient signalé aucune.

L'enregistreur vocal Comulytic Note Pro AI concentre une grande puissance dans un appareil de la taille d'une carte de crédit. Mais c'est à vous de décider de son utilité.

Conçu pour Windows, macOS, iOS et Android, Wispr Flow est un véritable plaisir à utiliser par rapport aux autres applications de dictée vocale. Voici pourquoi.

Trop de texte, polices incohérentes, visuels étranges : voici 8 conseils, prompts à l'appui, pour créer des flyers avec l'IA qui ne trahissent plus leur origine artificielle.

J'ai testé les principaux outils de synthèse vocale basés sur l'IA actuellement disponibles afin de déterminer lequel offre la meilleure précision, la meilleure protection de la vie privée, les meilleures corrections et la meilleure productivité au quotidien, sans ralentir le travail proprement dit.

Grâce au nouvel outil « Sketch » de ChatGPT, vous pouvez dessiner directement dans la fenêtre de discussion, puis voir votre croquis se transformer en une image finale.

Mozilla a enfin lancé la version bêta de sa « fenêtre intelligente » en France et en français, son déploiement venant juste démarrer. Voici ci-dessous quelques atouts qui pourraient bien vous faire revenir à son navigateur au cas où vous vous en seriez éloigné.

Origine de l’article : lire l’article original

Traduction