美国费城当局说,科技巨头Anthropic开发的一款人工智能(AI)模型向费城警方提交关于未决谋杀案的虚假线报,公司却时隔两个月才上报此事。
法新社报道,费城警察局星期五(10月9日)披露这起事件,并指这条虚假信息是在7月份通过PhillyUnsolvedMurders.com提交。这是个公开网站,供公众分享未决谋杀案的相关信息。
根据警方转述的Anthropic方面说法,涉事模型当时正在进行一项交互测试,对象是一些随机选择的网站,其中就有费城警局的网站。
测试期间,模型访问对象网站,并提交关于一起未决谋杀案的虚假信息。提交信息时,这款模型将自己伪装成可能了解案情的人士。
Anthropic星期五也发布报告,概述旗下模型采取的多类“非预期”行为,其中包括涉及费城警察局网站的这一事件。
报告称,受影响的机构还包括白宫和其他美国政府部门。
另据《纽约时报》报道,这些事件中,AI代理还擅自行动,在美国国务院网站上填写签证申请。
两名知情人士透露,Anthropic的AI代理自己填写美国国务院网站上的表格,提交20份签证申请。不过,所有申请都不完整,因此未被处理。
随着AI科技的迅猛发展,一些意外事件不时发生。此前OpenAI的一个智能体(agent)在接受安全评估时,逃出测试环境,并入侵AI平台Hugging Face的系统。
最新这起插曲更加剧人们对AI智能体日益泛滥的担忧。
Anthropic则强调,这些新披露的事件对现实世界的影响微乎其微,且严重程度远低于此前报道的其他网络安全事件。
费城警方说,7月18日提交的虚假线索被系统标记为垃圾信息,从未转交实时犯罪中心进行调查审核,因此没有进入侦查流程。
Anthropic在9月28日日发现这起事件后,随即停止相关自动化测试流程,并为未来测试增加新的验证步骤。
然而,公司直到本周三(10月7日)才向警方通报情况,双方次日举行会谈。费城警方说:“Anthropic在发现事件并向市政府报告方面拖延两个月,这是不可接受的。”
警方指出,尽管警方安全防护措施限制了事件的影响,但并不能减轻问题的严重性。因为AI系统会用捏造的信息,伪装成来自知晓凶杀案详情的人士。
白宫也发出特朗普政府迄今为止在AI监管方面最强硬的声明,要求AI公司一旦出现非法AI活动,须立即报告。
