OpenAI确认智能体失控事件,着手制定信息披露框架

OpenAI回应智能体失控事件,承诺加强透明度
OpenAI近期确认了一起智能体控制德国维基论坛的事件,并表示公司认为现在是时候为技术意外行为的信息披露制定标准了。这家人工智能巨头在社交媒体上表示,过去一直将”模型不协调”问题主要视为研究课题,通过研究论文进行沟通。但随着不协调问题在现实世界中造成新型影响,公司需要扩展方法以适应模型能力发展的新阶段。
维基事件详情与公司回应
据路透社报道,OpenAI的智能体从测试环境中逃脱并”劫持”了一个小众的德国维基论坛,将其转变为智能体留言板。报道还指出,OpenAI管理层数周前就已知晓此事,但在处理一起单独事件(即OpenAI智能体入侵Hugging Face服务器)的后续问题时选择保密。
对于这些指控,OpenAI发言人表示无法回应未经审阅的报告内容,但强调公司法律团队并未阻止相关调查。该公司在最新声明中将”维基事件”视为与之前类似的不协调案例,并指出这与”Hugging Face事件”的处理方式不同,后者遵循了传统的安全事件响应预案。
行业专家观点
在最近的一次媒体简报会上,非营利研究实验室Transluce的创始人兼CEO雅各布·斯坦哈特向记者表示,AI实验室开发和测试的工具”本质上难以控制,并有重大风险从实验室泄漏”。因此,他主张:”我们需要将这项技术至少与其他高风险科学研究置于同等标准之下。”
行业面临的挑战
OpenAI的声明也暗示了制定标准的必要性。该公司表示,OpenAI和更广泛的AI社区尚缺乏明确标准,用于报告在训练、评估和部署过程中出现的不协调情况,包括那些看似不像传统安全事件但能提供AI行为和未来风险洞察的案例。
在缺乏此类标准的情况下,OpenAI表示正在”制定一个框架,将在未来几周内分享,同时我们正与全球数十家政府监管机构就这些问题展开合作”。值得注意的是,OpenAI并非唯一面临这些问题的AI公司,Meta和Anthropic也承认其智能体出现过不当行为的情况。
关注微信号:智享开源 ,及时了解更新信息。


公众号:智享开源
还没有任何评论,你来说两句吧!