Meta 用員工每次按鍵訓練 AI 操控電腦

說個你可能沒想到的事。

Meta 最近宣布了一件事,但沒有大聲嚷嚷:他們要開始記錄員工的每一次鍵盤敲擊、每一次滑鼠點擊——用來訓練能自動操控電腦的 AI Agent。

不是外部用戶,是員工。是那些每天在 Meta 公司辦公室上班的人。

他們到底要收集什麼

按照 Meta 的說法,他們要抓取的資料包括:

  • 滑鼠移動軌跡
  • 按下了哪個按鈕
  • 在下拉選單裡選了什麼
  • 在各種應用程式裡的導航路徑

翻譯過來就是:你怎麼用電腦,他們都要錄下來。

Meta 對外的解釋是,這些資料會用來訓練幫助人們完成日常電腦任務的 AI Agent。

目的聽起來挺合理——想做一個真正能用電腦的 AI,最好的方式當然是看人類怎麼用。但問題在於,他們選擇的資料來源是自己的員工,而不是經過特別設計的資料收集流程。

為什麼這件事比聽起來更微妙

先說行業背景。

過去兩年,各家 AI 公司對下一代 Agent 的押注已經越來越向電腦操控傾斜——不是只會聊天,而是能打開應用、填表、點擊按鈕、幫你把事情做完。這類能力叫 computer use 或者 computer-use agent。

問題是,訓練這種 Agent 需要大量真實的人機互動資料。公開的資料集品質參差不齊,自己採集又貴又慢。

最方便的資料在哪裡?就在公司內部的員工那裡。

這不是 Meta 一家的想法。路透社的報導裡提到,這正在成為一種行業趨勢:Slack 聊天記錄、Jira 工單、員工的操作日誌,都在被各家公司悄悄納入 AI 訓練的考量範圍。

Meta 只是第一家把這件事明著說出來的。

合理嗎?

Meta 給出了一個標準答案:收集到的資料有保護措施,不會被用於其他目的。

但這個答案迴避了幾個真正的問題:

哪些應用在被監控? 如果你在用公司電腦登入私人帳號、查私人郵件,這些操作會被記錄嗎?

員工有拒絕權嗎? 還是這屬於入職協議裡已經授權的範圍,沒有選擇餘地?

資料能做到真正隔離嗎? 保證不用於其他目的很容易說,但在 AI 訓練鏈條上,資料的流向本來就很難追蹤。

這些問題,Meta 的聲明裡都沒有回答。

真正值得盯住的

Meta 要做 computer-use Agent 這件事本身不讓人意外。OpenAI 有 Codex,Anthropic 有 Claude Computer Use,Google 在測自主瀏覽器控制。這條賽道大家都在跑。

真正要盯住的是一個更大的問題:AI 訓練資料的邊界,正在被重新劃定。

之前大家討論的是能不能用網際網路公開資料訓練,現在開始有人問能不能用員工行為資料訓練,下一個會是什麼?用戶在產品裡的操作記錄?用戶和 AI 的對話歷史?

這些資料在使用條款裡可能都已經授權了,但用戶(或者員工)在簽協議的時候,大概沒想到這是在給 AI 打資料標註的工。

一個能代替人類操控電腦的 AI,需要人類的操作資料來學習——這本來是個技術問題,但現在開始變成一個更複雜的倫理問題。

Meta 的這個消息,是這場討論的開始,不是結尾。

參考來源:CocoLoop、Meta will record employees's keystrokes and use it to train its AI models(TechCrunch)