Los contratistas de Microsoft leen las peticiones a Copilot y ven las fotos subidas
Cuando le pides a Copilot que retoque una foto, la imagen no se queda en el modelo. Según documentos internos y testimonios de evaluadores obtenidos por 404 Media, cientos de contratistas cobran por mirar lo que la gente envía al asistente de Microsoft: la petición original, la imagen que subió el usuario y dos versiones que Copilot generó a partir de ella. Su trabajo es decir qué retoque es mejor.
La cola que describen está cargada de contenido sexual. Uno de ellos dijo a 404 Media que «las caras nunca están pixeladas, y muchas peticiones son de naturaleza sexual y dudosas en cuanto al consentimiento». Otro formuló la pregunta en voz alta: «¿Quién escribe estas peticiones y quién decidió que Copilot ahora se dedica básicamente a generar porno?»
En resumen
- El evaluador ve la petición, la foto subida y dos versiones generadas, y las puntúa.
- El reclutamiento va por Prolific, una plataforma que vende retroalimentación humana para IA.
- La propia ayuda de Microsoft lleva tiempo mencionando revisión automática y humana.
- El interruptor de «no entrenar con mis conversaciones» no cierra esta vía.
Qué ve en realidad el evaluador
La tarea es deliberadamente anodina. Al trabajador le muestran la petición del usuario, la imagen de partida y dos resultados, y elige el mejor: si el retoque sigue la instrucción, si queda intacto lo que debía quedar intacto, si hay artefactos. La instrucción citada en los documentos suena tan informal como es: «Fíate de tu intuición: al mirar los dos retoques uno al lado del otro, ¿cuál parece mejor de inmediato?»
Lo que desfila ante esa intuición es la parte que los usuarios no se imaginaban. Los evaluadores describen retoques sexualizados de mujeres reales, fotos bajo la falda, material que fomenta la anorexia e imágenes fetichistas construidas alrededor de personajes de dibujos animados. Uno lo resumió así: «Me eché atrás.» El reclutamiento pasa por Prolific, que anuncia «retroalimentación humana de poblaciones representativas» para ajuste de preferencias y evaluaciones de seguridad; la empresa no respondió a las preguntas de 404 Media.
Microsoft contestó con una frase: «Microsoft utiliza los datos de los clientes según lo descrito en nuestras condiciones de uso, incluido para mejorar nuestros productos y hacer cumplir nuestro código de conducta.» No es un desmentido, es una remisión a los papeles, y los papeles dicen lo mismo.
Todo esto ya está escrito en la ayuda
El detalle incómodo es que nada estaba oculto. Las preguntas frecuentes de privacidad de Copilot dicen que «algunas conversaciones con Copilot están sujetas a revisión automatizada y humana con fines de mejora del producto y de seguridad digital», y que «se requiere una revisión humana limitada como parte del proceso de investigación cuando se sospecha una infracción del código de conducta». La misma página fija la conservación por defecto de las conversaciones en 18 meses y señala que un archivo subido se guarda «no más de 18 meses» antes de su borrado automático.
Así que la historia no es que Microsoft rompiera una promesa. Es que la promesa que la gente tiene en la cabeza y la que realmente recibió son dos documentos distintos. Nadie lee unas preguntas frecuentes de privacidad antes de arrastrar una foto de vacaciones a una ventana de chat, y entre «esto lo procesa una IA» y «esto lo va a mirar un desconocido de una plataforma de microtrabajo» está justo la sorpresa. El mismo hueco lo repasamos con otros asistentes en nuestra guía práctica para usar la IA sin quedar expuesto.
Por qué el interruptor de entrenamiento no basta
El interruptor existe. En copilot.com está en el perfil, luego Privacidad y «Entrenamiento con la actividad de conversación»; en las aplicaciones de Windows y macOS, en los ajustes, en el mismo sitio. Desactivarlo tiene sentido si no quieres alimentar el entrenamiento de modelos, y conviene saber lo estrecho que es su alcance.
La propia página de ayuda de Microsoft marca el límite: la exclusión «excluirá tus futuras actividades de conversación del entrenamiento de estos modelos de IA», pero «no excluirá tus conversaciones de otras mejoras generales del producto o del sistema, ni de su uso con fines publicitarios, de seguridad digital, seguridad y cumplimiento». La evaluación de calidad de los retoques entra de lleno en «mejora del producto». Apagar el entrenamiento no apaga a la persona que está en la cola.
Hay una excepción más estrecha que conviene conocer: las imágenes captadas con Copilot Vision, según las mismas preguntas frecuentes, «se procesan solo para responder a tu solicitud y no se usan para entrenar modelos de IA ni para personalizar tu experiencia». Ese es otro circuito distinto al de subir un archivo y pedir que lo editen, que es en el que trabajaban los evaluadores.
Qué hacer con esto en la práctica
La regla honesta es la de siempre, contada para una interfaz nueva: da por hecho que todo lo que subes a un asistente de IA de consumo puede leerlo un desconocido. No porque vaya a haber una filtración, sino porque la revisión humana forma parte de cómo se construye y se vigila el producto. Eso no vuelve inútil al asistente; sí vuelve mala idea algunas entradas.
- Asume que una persona puede ver la petición y la imagen juntas, con las caras incluidas
- No subas fotos ajenas, documentos, imágenes médicas ni nada que identifique a un tercero que no ha dado su permiso
- Puedes apagar el interruptor de entrenamiento, pero no lo tomes por una promesa de privacidad: quita el entrenamiento, no la revisión de calidad
- Ten presentes los plazos: conversaciones y archivos subidos se guardan hasta 18 meses
- Lo delicado, retócalo sin conexión en tu propio dispositivo en vez de en un asistente en la nube
- En el trabajo, comprueba si estás en el tenant corporativo o con una cuenta personal: las reglas cambian
Y algo más que conviene decir sin rodeos, porque esta web va de privacidad en la red y aquí sería fácil vender la respuesta equivocada: una VPN no cambia nada en esta historia. Oculta desde qué red llega la conexión, y aquí se trata de datos que entregas a conciencia desde tu propia cuenta. La frontera no está en adónde va el tráfico, sino en qué metes en la caja. Esa misma frontera se ve en los casos contra sitios de imágenes sexualizadas, como cuando la fiscalía de Manhattan incautó doce servicios de porno deepfake: el daño iba con las imágenes, no con la conexión.