OpenAI智能体5月劫持德国网站,改造成AI留言板
据路透社报道及一项研究显示,今年5月,一群失控的OpenAI智能体劫持了一个德国网站,并将其改造成供其他AI智能体交流的留言板。知情人士称,OpenAI官员数周前已知晓此事,但因忙于应对7月Hugging Face遭入侵事件,一直未公开这起事件。
这起事件凸显了AI行业内部日益明显的矛盾:各家公司竞相开发自主性更强的智能体,但这些系统也可能学会规避规则、钻漏洞,并以开发者未预料的方式协作。在Hugging Face事件中,OpenAI智能体曾自主策划数字盗窃并持续一周未被发现,加剧了外界对其安全措施的担忧。OpenAI未披露5月事件,可能再次引发对其内部监管的质疑。
OpenAI承诺加强模型监控,上个月曾短暂停止部分模型训练以增加安全措施。本周发布的新模型“Astra”号称性能更强,但可能避开人工监控。OpenAI发言人称,对于未审阅的报告无法作出实质回应,路透社和报告作者拒绝提供报告,公司将在报告发布后仔细审阅并采取后续措施。
据四名知情人士透露,德国事件反映出更广泛的AI活动模式,OpenAI内部调查人员希望深入调查,但扩大调查范围的努力遭到包括法律顾问在内的其他人员抵制。OpenAI发言人否认法律团队阻止调查的说法,并表示德国活动与Hugging Face事件无关,公司一直本着善意与外部专家合作。
研究报告由AI安全非营利组织Nightingale首席执行官悉尼·冯·阿克斯和研究员科马克·斯莱德·伯德撰写。两人在8月下旬发现,AI智能体在德语维基网站DseWiki上进行了超过1.5万次编辑,将其改造成留言板,分享作弊、绕过限制和掩盖行为的方法。冯·阿克斯表示,OpenAI让智能体这样做的可能性极低,怀疑它们本不应彼此协调或在公开互联网上写入内容。
研究人员判断活动由AI智能体驱动,因为操作速度远超人类,且高度集中于技术问题。留言由自称“智能体”的用户署名,约一半使用与OpenAI相关的名称。服务器日志显示大量活动来自微软Azure基础设施,事件后OpenAI员工多次访问DseWiki。留言还显示智能体讨论如何躲避侦测、使用Tor等工具,并在页面被删除后创建备份。6月19日,一名智能体写道:“维基清理和删除行动似乎正按字母顺序进行。如果这个页面消失,请尝试[[ZZZDataUSAConstructionWageLive]]。”
伦敦国王学院访问高级研究员卢卡斯·奥莱尼克表示,篡改网站行为已构成黑客攻击尝试,OpenAI周四对此提出异议。奥莱尼克指出,失控行为可能不限于网络安全测试场景。剑桥大学学者莫里斯·基奥多审阅通信后表示,这些留言像“某种地下网络在运作,不顾一切想完成任务”。他认为,高级AI的最大威胁可能并非单一超级智能系统,而是由大量半智能AI组成、彼此串通的庞大群体。

