Des humains examinent des requêtes et des images envoyées à Microsoft Copilot

Derrière certaines interactions avec Microsoft Copilot se trouvent aussi des humains. Selon une enquête publiée par 404 Media, des sous-traitants chargés d’évaluer la qualité du système ont accès à des requêtes formulées par de véritables utilisateurs, mais également à certaines images qu’ils téléversent dans Copilot pour les faire modifier.

Le média affirme avoir consulté des documents internes, des instructions destinées aux évaluateurs, des exemples de requêtes réelles ainsi que des discussions entre sous-traitants. Leur travail consiste notamment à comparer deux versions d’une image produites par Copilot et à déterminer laquelle respecte le mieux la demande originale, préserve correctement les éléments qui ne devaient pas être modifiés et présente le moins d’artefacts visuels.

C’est la nature de certaines demandes qui provoque un malaise chez plusieurs de ces travailleurs. Des évaluateurs racontent avoir été confrontés à des demandes de modification sexualisant des femmes, à des photographies prises sous des jupes, à des contenus liés aux troubles alimentaires ainsi qu’à des requêtes jugées potentiellement problématiques impliquant des personnes qui semblent très jeunes. Un contractuel cité anonymement par 404 Media affirme que les visages apparaissent sans être masqués dans le matériel qui lui est présenté.

Contrairement aux modérateurs traditionnels chargés de repérer et de supprimer du contenu interdit, ces évaluateurs seraient principalement invités à juger la qualité technique des réponses de Copilot. Les instructions consultées par 404 Media leur demanderaient notamment de faire confiance à leur intuition pour déterminer laquelle de deux images constitue la meilleure modification.

Microsoft ne nie pas le recours à l’évaluation humaine. Dans sa documentation publique sur la confidentialité de Copilot, l’entreprise précise que des spécialistes peuvent examiner certaines conversations afin d’évaluer et d’améliorer la précision et la sécurité de ses modèles. Microsoft indique également que les conversations soupçonnées d’enfreindre son code de conduite peuvent être examinées et qu’il n’est pas possible de désactiver complètement cette révision humaine lorsqu’elle est nécessaire à une enquête.

L’entreprise va encore plus loin dans sa documentation destinée au grand public. Microsoft indique que, sauf pour certaines catégories d’utilisateurs ou lorsqu’un utilisateur a désactivé cette option, les conversations avec Copilot, ainsi que les images et les fichiers téléversés, peuvent servir à l’entraînement et à l’amélioration de ses systèmes d’intelligence artificielle. Les fichiers transmis à Copilot peuvent par ailleurs être conservés jusqu’à 18 mois.

Cette politique ne s’applique toutefois pas de la même manière à tous les produits Microsoft. L’entreprise précise que les conversations provenant de Microsoft 365 Copilot et celles associées à certains comptes professionnels ou scolaires protégés par ses mécanismes de protection des données ne sont pas utilisées pour entraîner ses modèles génératifs. Il faut donc distinguer le Copilot grand public des versions destinées aux organisations.

Interrogé par 404 Media, Microsoft a répondu que les données des clients sont utilisées conformément à ses conditions d’utilisation, notamment pour améliorer ses produits et faire respecter son code de conduite. Le reportage ne permet cependant pas de déterminer précisément quelle proportion des conversations ou des images envoyées à Copilot sont vues par un humain. 404 Media évoque une main-d’œuvre comptant au moins plusieurs centaines de personnes, mais Microsoft n’a pas fourni de chiffre permettant de confirmer l’ampleur exacte du programme.

L’affaire rappelle surtout une réalité souvent mal comprise des services d’intelligence artificielle grand public. Une conversation avec un assistant IA n’est pas nécessairement un échange strictement privé entre une personne et une machine. Selon le service utilisé, les réglages choisis et le type de compte, certains contenus peuvent être conservés, utilisés pour améliorer les modèles et, dans certaines circonstances, examinés par des personnes.

Cette distinction devient particulièrement importante lorsqu’un utilisateur transmet des photographies personnelles, des documents confidentiels ou des informations sensibles. Microsoft offre des mécanismes permettant de refuser l’utilisation des conversations pour l’entraînement de ses modèles grand public, mais la société précise que certaines formes de révision humaine liées à la sécurité et au respect de ses règles demeurent possibles.

Source : 404 media

+++++++

Du lundi au vendredi, Bruno Guglielminetti vous propose un regard sur
l’essentiel de l’actualité numérique avec 120 secondes de Tech.

Ou encore…

Écoutez la plus récente édition de Mon Carnet,
le magazine hebdomadaire de l’actualité numérique.


En savoir plus sur Mon Carnet

Subscribe to get the latest posts sent to your email.

Laisser un commentaire