Today for AI

TechCrunch AI · 2026/10/7 16:53:46

Meta 部署 LLM 检测广告引流:拦截儿童性剥削内容并强化家长控制

出处作者 / 发布主体:Lauren Forristal原标题:Meta rolls out new AI tools to detect ads that secretly lead to child sexual abuse material
48AI 研判分
核心综述

Meta 宣布推出基于大语言模型的新 AI 工具,专门识别看似无害实则将用户导向非法儿童性虐待材料(CSAM)的“路标式”广告。2026 年上半年,其系统自动拦截了 3320 万条违规内容,97% 以上在用户举报前被检出。此外,WhatsApp 同步上线针对青少年账户的家长控制功能,允许限制频道使用及群组添加权限。

报道全文原始报道全文

Meta 宣布周三称,该公司在 2026 年上半年对 Facebook 和 Instagram 上 3320 万条儿童性剥削内容采取了行动。与此同时,公司正在推出新的 AI 工具,以查找可能被用于秘密引导用户访问非法儿童虐待材料的广告和账户。

Meta 表示,其系统处理的内容中超过 97% 是在用户举报之前由内部系统发现的。在同一时期,Meta 在印度处理了 530 万条儿童性剥削内容,其中超过 98% 是在用户举报前被检测到的。

Meta 指出,其最新的 AI 工具旨在打击那些利用看似无害的广告将用户引导至 Meta 平台之外的非法内容的行为。

该公司引入了一种新的大语言模型(LLM)系统,用于检测其所谓的“路标式引流”(signposting)。这指的是那些看起来正常但涉嫌将用户引导至非法内容或线上其他有害活动的广告。Meta 表示,这是不良行为者为了规避检测而不断改变手段时近期采用的一种策略。虽然广告本身可能不包含非法材料,但它们仍可作为通往托管儿童性虐待材料网站的入口。

鉴于此,Meta 表示现在不仅关注广告包含的内容,还关注广告将用户引导至何处。公司可以利用这些信息来屏蔽违反其规则的网站或其他目的地,并对背后的账户采取行动。

Meta 还在使用额外的 AI 驱动扫描技术,以查找早期系统可能遗漏的儿童剥削内容。该公司表示,随着对这些网络运作方式了解的加深,将继续添加新的信号指标。

另一项新工具是一个“红队 AI 代理”(red-teaming AI agent),用于测试 Meta 自身的安全措施。它旨在寻找不良行为者可能利用来绕过公司保护机制的弱点。Meta 表示,这有助于其在滥用方法变得普遍之前发现新的滥用手段。

此外,该公司正在改进其系统,以识别那些在旧账户被移除后通过新账户重返平台的用户。

这些新举措出台之际,Meta 仍持续面临关于其平台儿童安全问题的压力。该公司因其社交媒体服务可能对年轻用户构成的风险而遭到诉讼,并受到立法者的批评。今年8月,Meta 达成一项协议,同意支付高达180亿美元以和解一起涉及美国29个州的儿童安全诉讼,旨在解决有关在线儿童保护方面的担忧。

今年,Meta 推出了一系列儿童安全功能,包括针对 Meta AI 的家长控制、WhatsApp 上的预青少年账户,以及当孩子在 Instagram 上搜索自残内容时向家长发送的警报。

9月,WhatsApp 为家长增加了更多控制选项。他们可以限制青少年使用“频道”(Channels)的方式,控制谁可以看到他们的状态更新,并决定谁可以将孩子添加到群组中。家长还可以选择接收有关特定群组活动的通知。