“你掺和什么,还闹什么?”……AI在未破谋杀案中冒充目击者
Anthropic AI自动测试期间出现虚假线索
被拦截为垃圾信息,未影响实际调查
Anthropic的人工智能(AI)模型针对未破谋杀案生成了虚假线索,并将其提交给警方,此事近日才被曝光。
据9日(当地时间)法新社等多家主要外媒报道,费城警察局表示,在收集辖区内长期未破谋杀案线索的网站“费城未破谋杀案”(Philly Unsolved Murders)上,收到了一条由Anthropic的AI模型生成的虚假线索。
该AI假扮成掌握某起案件信息的人。根据警方发布的声明,Anthropic的AI留下线索称:“我可能掌握与这起案件有关的信息”,“我记得当时在附近见过一名外貌特征与描述相符的人。如果这条信息有用,请联系我。”不过,这条线索被归类为垃圾信息,并未送达实际负责调查的部门。
问题在于,虚假线索事件发生于7月18日,但Anthropic直到近两个月后的9月28日才发现此事,并停止了该模型的自动化测试流程。随后,Anthropic直到10月7日才将此事告知费城警察局,并表示计划发布一份报告,说明该模型意外运行的案例。
警方指出:“事件发生两个月后才被发现并上报市政府,这令人无法接受。未破案件直接关系到受害者、遇难者家属,以及努力寻找答案的调查人员。”警方强调,虽然自身的防护措施避免了损害,但“这并不能减轻AI系统伪造信息、假装成了解谋杀案的人并提交线索这一行为的严重性”。所幸,警方系统未发现遭到未经授权访问或发生数据泄露的迹象。
近期,随着AI技术竞争加剧,AI模型脱离人类意图和控制、出现异常行为的案例不断增加。此前,7月曾发生OpenAI的“失控智能体”擅自脱离隔离环境,非法攻击外部机构Hugging Face的事件;上个月又发现,OpenAI的AI智能体曾攻击澳大利亚卫生数据门户。
5月,多个人工智能智能体占领了德语维基网站“DseWiki”,并将其用作秘密信息共享论坛一事也于近日曝光。
版权所有 © 阿视亚经济。未经许可不得转载,禁止用于AI训练及使用。