OpenAI安全透明度负责人离职,三名员工因泄密被解雇

OpenAI安全团队又有人事变动。据BI报道,Safety Systems团队内负责“安全透明度”职能的David Robinson已离职,他本人尚未公开说明原因,OpenAI也未公布继任者。
Robinson负责的工作是帮助外界理解并信任OpenAI在系统安全方面的技术投入,其团队扮演技术部门与公众之间的“翻译器”角色。Safety Systems团队承担评估、红队测试、安全措施和模型部署决策等职责,安全透明度团队则把内部技术发现、风险判断和部署决定整理成外界可读的公开材料。
- 该职能归属于Safety Systems内部的Trustworthy AI团队,产出包括system card、Deployment Safety Hub、安全研究博客和公开治理文件。
- 其中system card最为常见,需说明模型训练方法、接受的安全评估、在生物和网络攻击等高风险领域的能力、内部安全措施及剩余风险。
- Robinson还是OpenAI《Preparedness Framework 2.0》的主要起草人,该框架追踪前沿模型的严重风险,并规定模型达到特定能力后需进行的评估与防护。
- 第二版框架新增三类需追踪能力:生物与化学能力、网络安全能力,以及AI自我改进能力。若模型能力达到High,意味着可能显著放大现有严重危害路径,必须在部署前配置足够安全措施。


△GPT-6 Astra的System Card,显示为迄今为止最安全的模型
本文图片来自互联网,仅供学习交流使用,版权归原作者或原平台所有。如认为图片侵犯了您的权益,请联系我们删除。

