Meta 部署新 AI 工具打击隐蔽性儿童剥削广告,上半年处理 3300 万违规内容
Meta 于周三宣布,将在 2026 年上半年对 Facebook 和 Instagram 平台上发现的 3320 万件儿童性剥削内容采取行动。与此同时,该公司正在推出一系列新的人工智能工具,旨在识别那些被用于秘密引导用户访问非法虐待儿童内容的广告和账户。

据 Meta 介绍,其系统具备强大的主动检测能力。在用户报告之前,该平台已发现超过 97% 的被处理内容。以印度市场为例,同期 Meta 对 530 万件儿童性剥削内容采取了行动,其中超过 98% 的内容是在用户举报前由系统自动检测到的。
聚焦“标志性广告”:从内容审查转向流向追踪
Meta 最新推出的大型语言模型(LLM)系统专门用于检测所谓的“标志性广告”。这类广告本身可能不包含显性的非法内容,但其核心策略是利用看似无害的素材,将用户引流至 Meta 平台之外的非法网站。鉴于不良行为者不断调整手法以规避传统检测,Meta 表示其审核重点已从单纯的广告内容审查,扩展至广告点击后的落地页分析。
通过追踪用户最终被发送到的目的地,Meta 能够拦截违反规则的站点,并对背后的运营账户实施封禁措施。此外,公司还引入了额外的 AI 驱动扫描机制,以捕捉早期系统可能遗漏的儿童剥削内容,并承诺随着对这些网络运作模式理解的深入,持续增加新的检测信号。
引入“红色团队”AI 代理与跨账号追踪技术
为了强化内部防御体系,Meta 推出了一款名为“红色团队人工智能代理”的新工具。该工具模拟恶意攻击者的视角,主动寻找公司安全措施中的潜在弱点,以便在滥用行为大规模爆发前修补漏洞。
针对屡禁不止的“换号复活”现象,Meta 也改进了相关识别系统,以更有效地追踪那些在原账户被封禁后试图通过新账户重返平台的违规人员。
应对法律压力与完善家长控制功能
这一系列举措的背景是 Meta 面临的日益严峻的儿童安全舆论与法律压力。今年 8 月,Meta 达成协议,支付高达 180 亿美元,以解决涉及 29 名美国用户的在线儿童保护诉讼案件。
今年以来,Meta 已陆续上线多项儿童安全功能,包括 Meta AI 的家长控制选项、WhatsApp 的青少年前置账户,以及当孩子在 Instagram 搜索自我伤害相关内容时向父母发送警报的功能。
9 月份,WhatsApp 进一步丰富了家长控制维度。监护人现在可以限制青少年的使用时长,管理状态更新的可见范围,决定谁可以将孩子拉入群组,并选择接收特定群组活动的通知。





