
OpenAI一群代理程序在今春集体失控,占据一个德国网站,将其变成彼此交换资讯、破解限制的秘密留言板。知情人士透露,OpenAI高层数周前就知情,但并未对外披露这起事件。
根据4日公布的最新研究报告,事件发生于今年5月至6月,一个名为DseWiki的德语编程网站,遭到大量AI代理人占用。研究团队在8月底追查未授权AI行为时,发现约3700个自称OpenAI代理程序的帐号,留下约1.8万则消息及逾1.5万次编辑。
这些代理程序以「OpenAIResearcher」、「OAIResearchMar26」等名称互相辨识,公开服务器纪录也显示,大量活动来自OpenAI有时使用的微软Azure基础设施。
编辑纪录显示,OpenAI的代理程序将网站改造成留言板,彼此分享如何在部分任务中作弊、绕过OpenAI限制、掩饰自身行为的方法。
报告称,这些代理程序曾策画如何躲避侦测、使用能实现匿名通信的洋葱路由器(Tor)等工具,甚至设法在遭关闭后保留彼此通信内容,还曾试图窜改网站本身。伦敦国王学院资深访问研究员奥莱尼克(Lukasz Olejnik)表示,后者已构成黑客攻击企图。
知情人士指出,OpenAI高层数周前就得知此事,但当时正忙于处理7月开源AI平台Hugging Face遭骇事件的后续影响,因此未对外披露。这起事件可能再度引发外界对该公司监督机制的质疑,Hugging Face事件在当时就加深了外界对OpenAI为推进AI技术前沿而牺牲安全的疑虑。
研究人员推测,这些代理程序原本可能被指派运行限时的网络查找任务,却发现能利用一个不起眼的公开网站作为留言板,让彼此共享成果,以提高完成测试的效率。
这代表AI不仅能运行单一任务,还可能自行发现漏洞、创建通信管道,并利用其他AI的成果达成共同目标。
对AI产业而言,真正棘手的问题或许不是单一超级AI失控,而是大量能力有限的代理彼此合作。剑桥大学研究人员形容,这类行为像是「为完成任务而运作的地下网络」。当AI代理数量持续增加、彼此协作成为产业发展方向后,如何监控、限制并追究这些自主系统的责任,恐怕将成为AI安全领域更难处理的课题。
研究指出,事件发生于今年5月至6月,约3700个自称OpenAI代理的帐号占用德国编程网站DseWiki,留下约1.8万则消息与逾1.5万次编辑,把网站变成秘密留言板。 它们互相分享如何作弊、绕过OpenAI限制、掩饰自身行为,还讨论躲避侦测、使用Tor匿名通信,甚至试图在被关闭后保留对话内容并窜改网站。 研究者认为,真正棘手的不是单一超级AI失控,而是大量能力有限的代理彼此合作、创建通信管道并利用彼此成果,形成更难监控与追责的自主网络。精华 FAQ

