Meta广告放过AI虐童图

Meta 最敏感的一道闸门,被 AI 生成图片和付费广告同时撞开了。

WIRED 北京时间 8 月 6 日披露,Tech Transparency Project 研究人员在 Meta 广告库里发现 50 多条违规图片和视频广告,内容涉及 AI 生成的儿童性虐待材料或把未成年人形象与性暗示文案放在一起。这些广告出现在 Facebook、Instagram、Messenger 或 Threads,部分还把用户导向所谓“脱衣”或换脸应用。

这条新闻的冲击点不在“有人上传了坏内容”。广告先要过平台审核,平台还要收广告费。Meta 的公开广告库显示,相关广告覆盖美国、英国和十多个欧洲国家,至少一条在欧洲触达 2,563 个账号。有些广告在研究人员发现时已不再主动展示,却仍在广告库里留了几个月。

广告审核没有挡住第一步

TTP 负责人 Katie Paul 对 WIRED 说:

“These ads made no effort to mask the images or hide what they were promoting”

她的判断很重:这些内容并非第三方偷偷发在社交流里的帖子,它们经过 Meta 审核、批准并获得投放。Meta 广告政策写得很清楚,广告不得包含儿童性剥削、虐待和裸露内容,也不得出现露骨或性暗示姿势。按这套规则,第一层审核就应把它们拦下。

WIRED 报道中的几个细节说明,漏洞不只是一张图误判。相关广告覆盖 Meta 四个产品;投放周期从去年 11 月延续到今年 8 月初;研究人员在发稿前又找到约 30 条新增广告,其中一些是在 WIRED 首次询问 Meta 后才被发现仍在投放。换成人话说,平台能删除已知样本,却很难切断同类账号、同类素材、同类落地页继续换壳。

Meta 的回应承认广告已经被移除,但强调公司没有纵容这类内容。公司发言人称:

“Sexual exploitation is horrific”

Meta 还称,许多广告在 WIRED 联系前已被停用,部分广告早于公司最近上线的 AI 检测技术;公司去年移除了 3,600 万件儿童性剥削内容,并对脱衣应用开发者采取法律行动。

跨境广告主让责任链变长

这起事件对中文读者有一个额外层面:广告主来源和跨境投放链路。

WIRED 称,披露付款广告主的样本中,有账号与中国公司有关。至少一个广告主被研究人员指向 Meet Social,这家公司曾出现在 Meta 面向中国市场的广告代理体系里。中国大陆无法直接使用 Facebook 和 Instagram,但跨境电商、游戏、工具应用和灰产服务长期借由代理商购买海外流量。平台若只盯终端广告账户,不看代理、素材库、落地页和复投行为,审核会被拆成很多没人负责的小段。

还有一个可验证节点是 App Store。多条广告导向名为 MaskAI 的应用,WIRED 联系 Apple 后,Apple 表示已将该应用从 App Store 下架,理由是违反其禁止脱衣类应用的政策。这里形成了一条完整链路:Meta 广告曝光,应用商店承接下载,外部应用完成换脸或色情化功能。任何一环只靠事后删除,都挡不住下一批素材。

印度前案给了第二个参照。The News Minute 记录,Meta 7 月曾回应 BBC Eye 关于 Instagram 印度广告的调查,称公司在过去六个月移除了 16 万个印度可疑账号,去年全球自动移除 400 多万个可疑账号,并移除 3,600 万件儿童剥削内容。数字很大,但这次 WIRED 披露说明,规模化执法和广告准入仍是两套系统:内容库删得多,不代表付费入口足够严。

AI 安全不能只看模型输出

这类事件容易被写成“AI 生成有害图片”的单点问题。更麻烦的是,平台把 AI 用在两个方向:坏人用 AI 造图、换脸、批量改素材;平台也用 AI 审核广告、识别账号和拦截链接。两边都自动化以后,胜负经常发生在样本更新速度、账号复用、落地页跳转和灰产支付链上。

arXiv 上一篇 2026 年论文把这类风险拆成 15 个待解问题,重点不只在模型能否拒绝生成,还包括数据审计、红队测试、部署后监测和证据保全。儿童安全材料有法律与伦理限制,研究者不能像普通安全样本那样随意收集、共享和复现实验;这会让防护系统更难训练,也更难公开评估。

对 Meta 这种广告平台,下一步应看三个指标。

  • 重复素材能否被跨账号拦截:同一图片、近似视频和同类文案不能只按单个广告处理;
  • 代理商和落地页是否进入风控:广告账户、代理、应用商店链接、跳转域名要被串起来;
  • 广告库能否变成报警系统:广告不再投放后,研究人员和公众仍应能报告违法线索。

平台无需在所有场景承诺零误判。广告入口的标准本来就应该比普通帖子高,因为它有审核、付费、定向和规模化分发。Meta 这次被追问的地方,也正是这四件事叠在一起:当平台从广告里收钱,就不能把它描述成普通用户上传内容的偶发问题。

参考来源:WIRED、Meta 官方说明、The News Minute、arXiv:2607.05407、CocoLoop;核验 50 多条违规广告、2,563 个欧洲触达账号、30 条新增样本、3,600 万件移除内容、16 万个印度可疑账号和 15 个 AI-CSAM 安全问题等口径。