Les prestataires de Microsoft lisent les requêtes Copilot et voient les photos envoyées
Quand vous demandez à Copilot de retoucher une photo, l'image ne s'arrête pas au modèle. Selon des documents internes et des témoignages d'évaluateurs obtenus par 404 Media, des centaines de prestataires sont payés pour regarder ce que les gens envoient à l'assistant de Microsoft: la requête d'origine, l'image téléversée par l'utilisateur et deux versions produites par Copilot. Leur travail consiste à dire quelle retouche est la meilleure.
La file d'attente qu'ils décrivent est largement sexuelle. L'un d'eux a déclaré à 404 Media que «les visages ne sont jamais floutés, et beaucoup de requêtes sont de nature sexuelle et douteuses du point de vue du consentement». Un autre a posé la question à voix haute: «Qui écrit ces requêtes, et qui a décidé que Copilot servait désormais surtout à produire du porno?»
En bref
- L'évaluateur voit la requête, la photo téléversée et deux versions générées, puis les note.
- Le recrutement passe par Prolific, une plateforme qui vend du retour humain pour l'IA.
- L'aide de Microsoft mentionne depuis longtemps une relecture automatique et humaine.
- Le réglage «ne pas entraîner sur mes conversations» ne ferme pas ce chemin.
Ce que voit réellement l'évaluateur
La tâche est volontairement banale. On montre au travailleur la requête de l'utilisateur, l'image source et deux résultats, et il choisit le meilleur: la retouche suit-elle la consigne, ce qui devait rester intact est-il intact, y a-t-il des artefacts. La consigne citée dans les documents est aussi désinvolte qu'elle en a l'air: «Fiez-vous à votre intuition: en regardant les deux retouches côte à côte, laquelle paraît immédiatement meilleure?»
Ce qui défile devant cette intuition, les utilisateurs ne l'avaient pas imaginé. Les évaluateurs décrivent des retouches sexualisées de femmes réelles, des photos prises sous les jupes, du matériel qui encourage l'anorexie et des images fétichistes construites autour de personnages de dessins animés. L'un d'eux a dit simplement: «J'ai eu un mouvement de recul.» Le recrutement passe par Prolific, qui vante un «retour humain issu de populations représentatives» pour l'ajustement des préférences et les évaluations de sécurité; l'entreprise n'a pas répondu aux questions de 404 Media.
Microsoft a répondu en une phrase: «Microsoft utilise les données des clients comme décrit dans nos conditions d'utilisation, notamment pour améliorer nos produits et faire respecter notre code de conduite.» Ce n'est pas un démenti, c'est un renvoi aux documents, et ces documents disent la même chose.
Tout cela est déjà écrit dans l'aide
Le détail gênant, c'est que rien n'était caché. La FAQ de Microsoft sur la confidentialité de Copilot indique que «certaines conversations avec Copilot font l'objet d'un examen automatisé et humain à des fins d'amélioration du produit et de sécurité numérique», et qu'«un examen humain limité est nécessaire dans le cadre de l'enquête lorsqu'une violation du code de conduite est suspectée». La même page fixe la conservation par défaut des conversations à 18 mois et précise qu'un fichier téléversé est gardé «pas plus de 18 mois» avant suppression automatique.
L'histoire n'est donc pas celle d'une promesse rompue. Elle est que la promesse que les gens ont en tête et celle qu'ils ont réellement reçue sont deux documents différents. Personne ne lit une FAQ de confidentialité avant de glisser une photo de vacances dans une fenêtre de discussion, et c'est entre «une IA traite ceci» et «un inconnu d'une plateforme de microtravail va regarder ceci» que loge la surprise. Nous avons décrit le même écart pour d'autres assistants dans notre guide pratique pour utiliser l'IA sans se découvrir.
Pourquoi le réglage d'entraînement ne suffit pas
Le réglage existe. Sur copilot.com il se trouve dans le profil, puis Confidentialité, puis «Entraînement sur l'activité des conversations»; dans les applications Windows et macOS, dans les paramètres, au même endroit. Le désactiver a du sens si vous ne voulez pas nourrir l'entraînement des modèles. Encore faut-il savoir à quel point sa portée est étroite.
La page d'aide de Microsoft trace la limite noir sur blanc: le refus «exclura vos activités de conversation futures de l'entraînement de ces modèles d'IA», mais «n'exclura pas vos conversations d'autres améliorations générales du produit ou du système, ni de leur utilisation à des fins publicitaires, de sécurité numérique, de sécurité et de conformité». L'évaluation de la qualité des retouches relève exactement de «l'amélioration du produit». En coupant l'entraînement, on n'a pas coupé l'humain dans la file.
Une exception plus étroite mérite d'être connue: les images capturées avec Copilot Vision sont, selon la même FAQ, «traitées uniquement pour répondre à votre demande et ne sont pas utilisées pour entraîner des modèles d'IA ni pour personnaliser votre expérience». C'est un autre circuit que celui du fichier téléversé avec une demande de retouche, et c'est dans ce second que travaillaient les évaluateurs.
Ce qu'il faut en faire concrètement
La règle honnête est ancienne, simplement reformulée pour une nouvelle interface: considérez que tout ce que vous téléversez dans un assistant IA grand public peut être lu par un inconnu. Non parce qu'une fuite menace, mais parce que la relecture humaine fait partie de la façon dont le produit est fabriqué et surveillé. L'assistant n'en devient pas inutile; certaines entrées, elles, sont une mauvaise idée.
- Partez du principe qu'une personne peut voir la requête et l'image ensemble, visages compris
- Ne téléversez pas les photos d'autrui, des documents, des images médicales ni rien qui identifie un tiers qui n'a rien accepté
- Désactivez le réglage d'entraînement si vous le souhaitez, mais n'y voyez pas une promesse de confidentialité: il retire l'entraînement, pas la relecture qualité
- Gardez les durées en tête: conversations et fichiers téléversés restent jusqu'à 18 mois
- Pour le sensible, retouchez hors ligne sur votre appareil plutôt que dans un assistant en ligne
- Au travail, vérifiez si vous êtes dans le tenant de l'entreprise ou connecté avec un compte personnel: les règles diffèrent
Une dernière chose à dire franchement, puisque ce site parle de confidentialité réseau et qu'il serait facile d'y vendre la mauvaise réponse: un VPN ne change rien à cette histoire. Il masque le réseau d'où vient la connexion, alors qu'il s'agit ici de données que vous remettez sciemment depuis votre propre compte. La frontière n'est pas là où va le trafic, elle est dans ce que vous mettez dans la boîte. On retrouve la même frontière dans les poursuites contre les sites d'images sexualisées, par exemple quand le parquet de Manhattan a saisi douze services de porno deepfake: le préjudice suivait les images, pas la connexion.