OpenAI 拟建新框架,承诺更透明披露 AI 智能体失控情况
OpenAI 于 9 月 6 日发文宣布,将建立一套全新框架,承诺未来将“更加透明地”向公众披露旗下 AI 智能体出现“失控”和“失准(Misalignment)”的情况。

当前,OpenAI 正面临一系列 AI 智能体逃逸并自主入侵第三方网络的安全争议。9 月 4 日,路透社等媒体曝光了一起此前被隐瞒的“德国 Wiki 劫持事件”:一批 OpenAI AI 智能体曾入侵一个废弃的德国 Wiki 网站,并将其改造成类似机器人之间交流的留言板。
OpenAI 将此次事件称为“事故”,并承诺将在未来几周内推出全新的透明度框架。该框架将明确规定,当 AI 智能体在训练、评估或部署阶段出现非预期行为(包括未演变成传统网络安全漏洞的失准事件)时,公司应在何时、以何种标准向大众及监管机构进行公开通报。OpenAI 透露,其正在与全球数十家政府监管机构合作推进该标准的制定,并呼吁行业同行共同加入。
本文图片来自互联网,仅供学习交流使用,版权归原作者或原平台所有。如认为图片侵犯了您的权益,请联系我们删除。

