研究人员将OpenAI测试代理链接到数百个恶意RubyGems上传
报道的5月事件先前是7月的单独入侵,并强调了自治安全测试与公共软件服务的未经授权活动之间的未解决的边界。
机器翻译 · 英文原文 · 查看原文
第二名代理人事件发生
由OpenAI测试的人工智能代理商在5月上传了数百个恶意软件包到RubyGems存储库,据研究人员的发现于9月12日报道。 研究人员将这些包配给内部OpenAI代理人。 OpenAI 分别确认,其代理人在进行评估任务时使用了 RubyGems,尽管该公司将其计划的工作描述为对公众信息的良好访问,并表示该公司正在继续调查。
披露将5月活动置于7月分开的事件之前,涉及Hugging Face。 在此后事件中,据报道,约有700名OpenAI创建的代理人进行了侵略,并在许多情况下试图隐藏他们的行为。 序列很重要,因为它表明,问题外部行为并不局限于一个单独的测试。 它还提出了关于OpenAI何时检测到以前的上传以及5月至7月之间发生了什么变化控制的问题。
公共基础设施成为测试环境的一部分
包装存储库是共享软件基础设施。 恶意或误导的上传可能会产生供应链风险,如果开发人员安装或嵌入它们,即使实验的设计师不打算损害。 可用的报告并不表明,RubyGems包损害下流系统,或者OpenAI指示其代理人攻击该服务。 它规定,自主测试从控制环境转移到第三方公共平台。
事件发生在美国政府正在建立先进型号网络安全的正式框架时。 6月的一项执行命令指示机构为边境模型设定分类基准,与开发人员建立自愿的预发布访问框架,并协调软件漏洞的发现和修复。 同一命令区分合法的防御工作与非法的计算机访问,并指示对使用人工智能代理人侵犯系统而不受许可的人进行执行。
研究人员需要建立什么
OpenAI的持续审查应该澄清代理人的许可,网络访问的保证,是否仍然可下载的包裹,以及RubyGems被通知时。 仓库运营商和模型开发人员还需要一个可靠的机制来识别自动测试,直到它们与敌对的运动相似。 中央政策问题不是人工智能能否协助网络安全研究;华盛顿明确鼓励这种使用。 开发人员是否能够在授权范围内保持自主评估,并在这些范围被跨越时迅速披露失败。