AI安全护栏阻碍网络安全研究员工作

AI安全护栏引发网络安全研究困境
近几个月来,人工智能巨头们纷纷制定了特殊的审查程序和严格的安全护栏,旨在限制恶意黑客使用其模型。然而,这些限制措施如今却阻碍了合法网络防御者以及网络安全进攻研究员的正常工作。
政府干预与模型限制
今年6月,美国政府因一则报告称可以绕过Anthropic旗下AI模型的护栏——这些护栏本意是防止用户利用模型构建和执行恶意网络攻击——而对备受瞩目的Mythos和Fable AI模型实施了出口管制限制。
无论这一事件是否真的源于对”越狱”的担忧,事实是Anthropic一直将其Mythos模型宣传为某种”末日网络机器”,只能提供给经过严格筛选的用户使用,并且即使如此,仍需配备严格的安全护栏。(值得一提的是,Fable 5和Mythos 5的出口管制限制已被解除。Fable 5已于7月1日恢复公开访问;Mythos 5则仅重新提供给经过审查的美国组织,作为政府审查过程的一部分。)
行业普遍的准入限制
这种准入限制并非Mythos独有。无论是Anthropic的其他模型,还是OpenAI,都为网络安全研究员提供了可以申请加入的审查项目——一旦获批,即可访问网络安全限制较少的模型:OpenAI的”网络安全可信访问计划”和Anthropic的”网络安全验证计划”。
研究人员的批评与质疑
这些安全护栏受到了广泛批评,尤其是那些职责在于发现系统中未知漏洞,并在犯罪分子之前设计出利用方法的研究人员。
在最近一次网络安全播客节目中,著名安全研究员马克·道德(Mark Dowd)表示:”这些大型公司随意决定什么是安全的、什么不安全的,这让我感到非常不安。”
道德花费数十年时间寻找并向西方政府出售”零日漏洞”(即先前未知的软件缺陷及其利用方法),而非向软件制造商报告以便修复。政府愿意为漏洞支付高价,恰恰因为它们保持开放状态,这对情报行动很有价值。
攻防工具的双重性
道德承认他的工作可能使他带有偏见,但他并非孤例。多位从事网络安全进攻工作的人员(他们主动探测系统弱点)向媒体描述了他们如何使用AI工具并应对其安全护栏。
安全咨询巨头NCC Group的首席科学家克里斯·安利(Chris Anley)表示,要求AI模型尝试利用某个漏洞是确认其为值得修复的真实漏洞的关键步骤。但如果护栏导致模型直接拒绝回答问题,那么这些护栏实际上伤害了防御者。
安利解释道:”这就是进攻与防御以及护栏问题的全部所在,因为’修复这段代码’这一提示既是防御的必要机制,也是发现代码库中关键漏洞的路线图。因此,同一工具既是进攻工具,也是防御工具,两者难以分割。”
他继续比喻道:”这就像一把锤子。没有锤子就无法建造房子。它绝对是工具,但也同样不可回避地是一种武器。”
应对策略与行业分歧
当他和他的同事遇到此类障碍时,有时会退回到完全没有护栏的开源AI模型。
开发、收购并向政府机构出售未知漏洞的知名公司Crowdfense的首席技术官保罗·斯塔格诺(Paolo Stagno)同意道德的观点,认为AI公司”基本上像对待需要看管的孩子一样对待客户”。
斯塔格诺表示,他和同事确实使用前沿模型,但仅用于逆向工程。他们避免使用AI帮助寻找漏洞或构建漏洞利用程序,因为将这项工作输入云端模型存在敏感漏洞数据泄露或被未来训练运行吸收的风险。对于这一步骤,他说他们使用本地运行的开源模型,因为它们不依赖于将数据共享到模型外部。
寻找零日漏洞并开发利用程序的安全研究员朱塞佩·卡利(Giuseppe Cali)表示,护栏并未阻碍他的工作。因为他不将AI用于进攻性工作,而是用于初步逆向工程、理解分析的代码以及构建支持工具。他说,AI工具可以加速这个过程,让他能够专注于发现漏洞。
关注微信号:智享开源,及时了解更新信息。

公众号:智享开源
还没有任何评论,你来说两句吧!