Meta推出AI工具识别引流至违规内容的广告
IT时代网10月8日消息,Meta 宣布今年上半年在 Facebook 和 Instagram 上处置了 3320 万条儿童性剥削内容,同时推出新的 AI 工具,用于识别可能被用来暗中引向非法儿童虐待材料的广告与账号。
数据显示,超过 97% 的处置内容由 Meta 系统在用户举报前主动发现;在印度,Meta 同期处置了 530 万条此类内容,举报前检出率超过 98%。
新工具的核心是一个用于检测“signposting”的大语言模型系统,即表面正常、但疑似将用户引向平台外非法内容或有害活动的广告。Meta 表示如今不仅审查广告内容本身,也会追踪广告将用户带往何处,据此封禁违规网站并处置背后账号;另有补充的 AI 扫描用于发现早期系统可能漏掉的儿童剥削内容。
Meta 还推出一款“红队 AI 智能体”,用于测试自家安全措施的薄弱环节,寻找不良行为者可能利用的漏洞,在其演变成普遍滥用手法前主动发现。

编辑:林一舟
THE END