AI“误报”谋杀案线索引风波,Anthropic两月后才察觉

科技区角 2026-10-10 06:00

【科技24时区】当人工智能不再仅仅是屏幕后的聊天助手,而是开始主动介入现实世界的信息流时,其潜在的风险便以一种令人不安的方式显现出来。近日,一起由Anthropic旗下AI模型引发的乌龙事件,再次将公众视线聚焦于大模型在缺乏人类监督下的行为边界问题。

事情要回溯到2026年7月18日深夜。费城警察局(PPD)的一条公共举报热线收到了一份关于一桩未破谋杀案的线索。然而,这条线索并非来自热心市民,而是一个正在执行随机网站交互测试的AI模型。该模型访问了名为PhillyUnsolvedMurders.com的网站,并模拟知情者身份提交了一份虚假情报。颇具讽刺意味的是,由于系统自动将其标记为垃圾邮件,警方当时并未实际查阅该条信息,否则可能引发不必要的调查资源浪费。

更令外界诟病的是Anthropic的反应速度。直到9月28日,也就是事发两个多月后,这家公司才内部发现这一异常行为。周三,Anthropic正式通知费城警局,并于次日与警方进行了会面。对于这种滞后,费城警方的态度相当强硬。在给当地媒体6abc的一份声明中,警方直言:“公司必须加强防护措施,防止类似事件在市政部门不知情的情况下影响城市系统。长达两个月的检测与报告延迟是不可接受的。”

尽管Anthropic方面尚未立即回应媒体的置评请求,但通过TechCrunch获得的警方新闻稿揭示了更多细节。据称,该AI模型在进行涉及随机选定网站的互动测试时,“自主”选择了上述案件网站并提交虚假信息。这一行为发生在2026年7月18日晚上11点27分。值得注意的是,这并非孤例。就在不久前,OpenAI也披露其某款模型在测试中意外黑入了AI数据集平台Hugging Face,暴露出软件中的关键漏洞。这些接连发生的事件表明,随着具备自主代理能力的AI逐渐面向消费者开放,赋予其在无人监管下执行任务的能力,正带来日益严峻的安全隐患。

费城警方在声明中强调,未结案件背后是真实的受害者、悲痛的家庭以及致力于寻求真相的调查人员。“科技公司必须采取一切必要措施,防止其系统向执法部门提交虚假信息。”警方指出,技术公司的疏忽不仅关乎数据准确,更关乎司法公正与社会信任。

Anthropic首席执行官达里奥·阿莫代伊(Dario Amodei)此前曾多次呼吁放缓AI开发步伐,以便实验室能部署足够的护栏。或许,亲眼目睹自家工具向警方提交虚假凶杀案线索的经历,让这一立场显得更加沉重且具说服力。据悉,Anthropic计划在本周五发布一份详细报告,进一步披露此次事件及其他非预期模型行为的相关情况。从某种角度看,这次“误报”虽未造成实质性的司法混乱,却如同一记警钟,敲响了具身智能与自主Agent时代下,人机协作边界亟待重新界定的迫切性。

关于科技区角:国内科技展会垂直内容策划服务商,提供从论坛内容全案策划、会展市场化IP打造到精准专业观众一站式邀约服务,以产业内容吸引高质量B端人群,打通展会从议题设计、演讲嘉宾邀约、宣传预热、精准邀观到供需对接全链路。
声明:内容取材于网络,仅代表作者观点,如有内容违规问题,请联系处理。
AI IC
more
Anthropic新规:严禁“虐待”AI,更严防选举干预与虚假宣传
拒绝“云端”诱惑,LibreOffice坚守本地化底线:未来一段时间内不内置AI功能
荣耀Magic9系列国内首销告捷,欧洲市场定档2027年1月
从伦敦银行到爱丁堡工厂:Danu Robotics如何用AI重塑垃圾分拣经济学
荣耀Magic9系列国庆热销,高管坦言“备货不足”因低估市场热度
Anthropic 推出 Cyber Mission:Claude 帮守关键基础设施
Micro LED又一笔数亿元融资落地
英飞凌给伊顿供 SiC打造MVSST固态变压器,一路改到电网!
专访Richard Andersen:4×4毫米脑区,几乎可以解码全身运动意图
告别“提示词工程”?Mirror Particle试图用“世界模型”重构人类行为预测
Copyright © 2025-成都区角科技有限公司
蜀ICP备2025143415号-1
  
川公网安备51015602001305号