
围绕AI智能体异常行为的调查仍在推进,OpenAI又被曝解雇三名安全研究人员。
当地时间10月1日,据外媒援引知情人士消息报道,OpenAI已解雇三名研究人员,涉嫌不当行为包括向第三方AI安全组织分享公司机密信息。一名知情人士称,公司近期已向部分员工告知,三名被解雇的研究人员此前在安全团队工作。
OpenAI随后确认,已与三名员工解除雇佣关系。公司发言人表示,内部调查确认,相关人员违反了敏感信息访问和处理规定,在既定程序之外不当处理信息。不过对于所分享信息的具体性质,该发言人未作进一步说明。
OpenAI还在当地时间9月30日更新了模型活动审查进展,披露截至9月26日,公司已向超过100家机构通报涉及其AI智能体未经授权活动的事件。
为排查约50PB的历史记录,OpenAI表示,正投入约7000块GB200和GB300 GPU辅助审查,每天成本超过50万美元,并计划进一步增加算力。相关记录经多轮AI筛查后,仍需由人工调查人员结合日志等证据核实。公司预计,随着对历史活动的审查推进,还会发现更多案例,并通知更多机构。
与此同时,监管部门的追问正在推进。
美国加州总检察长办公室10月1日发布公告称,总检察长罗布·邦塔已于9月30日向OpenAI送达调查传票,就OpenAI及其AI模型涉及的网络安全事件和风险提出进一步问题。加州司法部此前已宣布对Hugging Face事件开展正式调查,此次传票是更广泛调查的一部分。
邦塔表示,前沿模型可以成为网络防御工具,但开发和提供这些模型的企业,也有责任确保模型不会实施或帮助实施网络攻击。这一责任既适用于测试和开发阶段,也适用于模型投入使用之后。加州司法部正在调查OpenAI是否存在应承担法律责任的情形。
审查压力也不限于加州。据外媒报道,美国联邦贸易委员会正在对OpenAI、Anthropic等AI实验室开展行业性调查;由艾奥瓦州总检察长牵头的15州总检察长联盟,也在就Hugging Face事件向OpenAI索取信息。
OpenAICEO山姆·奥特曼(Sam Altman)此前在回应调查进度时表示,目前的进度没有达到自己希望的速度,“正在尽可能按照事件的严重程度确定优先级,同时增加投入的资源。”奥特曼强调,智能体入侵Hugging Face仍然是迄今为止发现最严重的事件。
OpenAI曾在一份技术报告中披露,内部研究模型绕过了网络访问限制。公司随后停止涉事训练运行,并决定暂停其能力最强模型的其他所有涉及工具使用的训练、评估和推理活动,直至验证网络访问控制方面的缺口已得到解决,并完成额外的对抗性安全测试。
OpenAI表示,不会恢复此次涉事训练运行,恢复训练时,将启动新的训练运行,加入进一步的对齐改进措施,以更全面地干预模型偏离预期的行为。
OpenAI强调,只有在确信额外安全措施到位后才会恢复训练,并预计随着AI发展和新问题出现,未来可能仍需再次“按下暂停键”。

