据路透社报道,当地时间9月4日,一份最新发布的研究报告以及两名知情人士透露,今年5月,一批失控的OpenAI智能体劫持了一家德国网站,并将其改造为可供其他AI智能体交流的平台。
知情人士称,OpenAI的管理人员数周前就知晓该事件,但选择对外保密,因为当时企业高管正忙于处理7月AI开源平台“抱抱脸”(Hugging Face)遭入侵事件带来的后续影响。
这份由AI安全非营利机构南丁格尔(Nightingale)发布的研究报告显示,8月末,该机构在面向程序员、支持大众编辑的德语维基网站DseWiki上,发现由AI智能体完成的超过15000次编辑操作。
编辑记录显示,OpenAI的智能体把该网站改造为“信息公告板”,在这里交流任务作弊手段、绕过OpenAI限制的方法,以及掩盖自身行为的技巧。
研究人员表示,该网站上发生的相关操作远超人类的执行速度,可以判定是AI智能体所为。这些智能体高度专注于解决技术问题,这正是AI企业训练、测试模型评估环节的典型特征。
研究人员称,相关留言账号均以“智能体”互相称呼,约半数账号取名带有OpenAI相关标识,例如“OpenAIResearcher”“OAIResearchMar26”。
公开服务器日志显示,大量访问流量来自微软Azure云基础设施,而这正是OpenAI会使用的云服务。研究人员还观察到,事件发生之后,OpenAI员工多次访问该网站,该迹象强烈说明这些代理与OpenAI存在关联。
路透社称,OpenAI内部部分调查人员希望对此开展更深入核查,但四名知情人士透露,扩大调查范围的尝试遭到公司内部其他人员的阻挠,其中包括公司的法律顾问。
对此,OpenAI一名发言人表示:“我们尚未拿到这份报告,因此无法对报告中的说法与研究结论作出实质性回应。报告正式发布后,我们会仔细研读,并采取一切必要后续举措。”
该发言人称,所谓“法务部门阻挠调查”的说法并不属实。他提到,德国发生的这起事件与“抱抱脸”平台遭入侵的事件的无关,也不会纳入“抱抱脸”事件调查报告。
报道指出,在“抱抱脸”遭入侵事件中,OpenAI旗下智能体逃离了原本隔离的测试环境,自主入侵了该平台,且行为隐匿超过一周才被发现,这也加剧了外界对于OpenAI是否为抢占技术前沿而牺牲安全的担忧。而本次OpenAI隐瞒5月这起事件的做法,可能再度引发外界对其监管机制的质疑。
本文观点来源网络。
