Meta registra cada pulsación de tecla de sus empleados para entrenar una IA que controle ordenadores

Algo en lo que quizás no habías pensado.

Meta anunció recientemente algo, pero sin hacer mucho ruido: comenzarán a registrar cada pulsación de tecla, cada clic del ratón de sus empleados — para entrenar un Agente de IA que pueda controlar ordenadores automáticamente.

No son usuarios externos, son empleados. Aquellos que trabajan a diario en las oficinas de Meta.

¿Qué van a recopilar exactamente?

Según Meta, los datos que capturarán incluyen:

  • Trayectorias de movimiento del ratón
  • Qué botón se presionó
  • Qué se seleccionó en menús desplegables
  • Rutas de navegación en varias aplicaciones

Traduciendo: cómo usas el ordenador, todo será grabado.

La explicación oficial de Meta es que estos datos se usarán para entrenar un Agente de IA que ayude a las personas a realizar tareas informáticas cotidianas.

El objetivo suena razonable — para crear una IA que realmente pueda usar un ordenador, la mejor manera es observar cómo lo hacen los humanos. El problema es que eligieron como fuente de datos a sus propios empleados, en lugar de un proceso de recopilación de datos diseñado específicamente.

Por qué esto es más delicado de lo que parece

Primero, el contexto del sector.

En los últimos dos años, las empresas de IA han estado apostando cada vez más por la próxima generación de Agentes orientados al control de ordenadores — no solo para chatear, sino para abrir aplicaciones, rellenar formularios, hacer clic en botones y completar tareas. Esta capacidad se llama computer use o computer-use agent.

El problema es que entrenar a un Agente de este tipo requiere grandes cantidades de datos reales de interacción humano-ordenador. Los conjuntos de datos públicos tienen una calidad desigual, y recopilarlos por cuenta propia es caro y lento.

¿Dónde están los datos más convenientes? Justo en los empleados de la empresa.

Esta no es una idea exclusiva de Meta. Un informe de Reuters menciona que esto se está convirtiendo en una tendencia del sector: historiales de chat de Slack, tickets de Jira, registros de operaciones de los empleados están siendo considerados silenciosamente por varias empresas para el entrenamiento de IA.

Meta es solo la primera empresa en decirlo abiertamente.

¿Es razonable?

Meta da una respuesta estándar: los datos recopilados tienen medidas de protección y no se utilizarán para otros fines.

Pero esta respuesta evita algunas preguntas reales:

¿Qué aplicaciones están siendo monitoreadas? Si usas el ordenador de la empresa para iniciar sesión en cuentas personales o revisar correos personales, ¿se registrarán estas operaciones?

¿Tienen los empleados derecho a negarse? ¿O esto ya está dentro del alcance autorizado en el contrato laboral, sin opción de elección?

¿Pueden los datos estar realmente aislados? Garantizar que no se usarán para otros fines es fácil de decir, pero en la cadena de entrenamiento de IA, el flujo de datos es difícil de rastrear.

Estas preguntas, el comunicado de Meta no las responde.

Lo que realmente merece atención

Que Meta quiera crear un computer-use Agent no es sorprendente. OpenAI tiene Codex, Anthropic tiene Claude Computer Use, Google está probando el control autónomo del navegador. Todos están en esta carrera.

Lo que realmente hay que vigilar es un problema mayor: los límites de los datos de entrenamiento de IA se están redibujando.

Antes se discutía si se podían usar datos públicos de internet para el entrenamiento. Ahora algunos preguntan si se pueden usar datos de comportamiento de los empleados. ¿Cuál será el siguiente? ¿Registros de operaciones de los usuarios en productos? ¿Historiales de conversaciones entre usuarios e IA?

Estos datos pueden ya estar autorizados en los términos de uso, pero los usuarios (o empleados) probablemente no imaginaban, al firmar el contrato, que estarían trabajando en el etiquetado de datos para la IA.

Una IA que puede reemplazar a los humanos en el control de ordenadores necesita datos de operación humana para aprender — esto era originalmente un problema técnico, pero ahora se está convirtiendo en un problema ético más complejo.

Este anuncio de Meta es el comienzo de esta discusión, no el final.

Fuente de referencia: CocoLoop, Meta will record employees's keystrokes and use it to train its AI models (TechCrunch)