Meta上半年处置3320万条涉儿童剥削内容,AI“红队”主动猎杀隐蔽违规链

科技区角 2026-10-08 02:01

【科技24时区】当数字世界的阴暗角落试图利用算法的缝隙潜行时,平台方的防御战已不再是被动的删帖,而是一场针对底层逻辑的主动围剿。周三,Meta公布了一组令人触目惊心的数据:在2026年上半年,其旗下Facebook和Instagram平台共处置了3320万条涉及儿童性剥削的内容。这一庞大的数字背后,并非单纯依靠用户举报,而是彰显了自动化系统的主导地位——超过97%的违规内容是在用户发现之前,由Meta的内部系统率先识别并拦截的。

值得注意的是,这种技术压制力在不同区域呈现出差异化的高压态势。以印度市场为例,同期Meta在该国处置了530万条此类有害内容,其中逾98%由系统在用户举报前侦测到。这表明,随着全球监管压力的加剧,Meta正将更密集的算力资源投向高风险区域,试图在源头切断伤害链条。

然而,黑产团伙的手段也在不断迭代,他们开始玩起“指路牌”(signposting)的游戏。这是一种极具迷惑性的新战术:广告本身看似人畜无害,甚至完全合规,但其链接指向的却是平台之外的非法内容网站或从事其他有害活动的页面。面对这种“借道杀人”的策略,Meta传统的基于内容本身的审核机制显得捉襟见肘。为此,公司引入了全新的大语言模型(LLM)系统,专门用于检测这类隐蔽的导流行为。现在的审核逻辑发生了根本性转变:不仅看广告里有什么,更要看广告把用户带向何方。一旦确认目的地违反规则,Meta不仅能封锁相关网站,还能顺藤摸瓜,对背后的账户实施精准打击。

在这场猫鼠游戏中,被动防御显然不够。Meta还部署了一种名为“红队AI代理”(red-teaming AI agent)的新工具,这相当于给自家的安全系统找了一个“假想敌”。该AI会模拟恶意攻击者的思维,主动寻找现有防护措施的漏洞和弱点。这种自我攻击式的测试,旨在让平台在黑产手段大规模普及之前,就能预判并修补潜在的安全盲区。与此同时,额外的AI驱动扫描也被投入战场,用以捕捉早期系统可能遗漏的儿童剥削内容,并通过持续学习网络运作模式,不断添加新的风险信号。

除了技术层面的升级,Meta还在身份追踪上加大了力度。对于那些在被封号后换个马甲重新注册、试图卷土重来的违规者,公司正在优化其识别系统,力求实现跨账号的身份关联与阻断。

这些举措的推出,绝非无的放矢。长期以来,Meta因未能有效保护未成年人免受社交媒体风险侵害,面临着来自立法者和公众的巨大压力。今年8月,Meta同意支付高达180亿美元,以和解涉及美国29个州的儿童安全诉讼,这笔天价罚金无疑是对平台责任缺失的一次沉重警示。从法律纠纷到产品整改,Meta今年的动作频频:为Meta AI引入家长控制功能,在WhatsApp上开设青少年专用账户,以及当孩子在Instagram搜索自残相关内容时向父母发送警报。

进入9月,WhatsApp进一步收紧了对青少年的管控权限。家长现在可以限制孩子使用“频道”(Channels)功能,控制谁能查看孩子的状态更新,甚至决定谁可以将孩子拉入群组。此外,特定群组的活动通知也将直接推送给监护人。从单纯的內容删除到构建全方位的监护闭环,Meta正试图用技术手段重构其在儿童安全领域的信任基石,尽管这场战役远未结束。

关于科技区角:国内科技展会垂直内容策划服务商,提供从论坛内容全案策划、会展市场化IP打造到精准专业观众一站式邀约服务,以产业内容吸引高质量B端人群,打通展会从议题设计、演讲嘉宾邀约、宣传预热、精准邀观到供需对接全链路。
声明:内容取材于网络,仅代表作者观点,如有内容违规问题,请联系处理。
AI
more
太魔幻!野生博主直播给 AI 上刑,几十万人看不下去了!
AI“失语症”蔓延:从代码黑话到文言复兴,算力焦虑下的语言异化
Healthleap获3800万美元融资,AI挖掘病历“隐形”风险
展期论坛 | CPO与硅光驱动 AI Factory 新基建论坛,议程及嘉宾阵容抢先看
零代码也能造游戏?Google推出AI平台Playground,文本指令即成现实
森萨塔汽车传感器收入过半,但已经不是主角,AI服务器才是!
AI上车,谁在领跑下半场?
腾讯偷偷内测“AI美女陪玩”,真人陪玩要集体失业了?
典当行惊现半价M5 MacBook Air,激活锁成“拦路虎”引热议
传音控股拟赴港募资33.6亿港元,AI研发成资金主要去向
Copyright © 2025-成都区角科技有限公司
蜀ICP备2025143415号-1
  
川公网安备51015602001305号