人类学家发出公众警告,因为一个人在AI竞赛上传
来自领先的人工智能实验室内部的警告加剧了国际监督的需求,尽管研究人员的灾难性预测仍然是判断而不是验证的预测。
机器翻译 · 英文原文 · 查看原文
警告在实验室外移动
三个人类研究人员公开提出了对未来的人工智能系统可能逃避有意义的人类控制的担忧,而研究人员雅各布·科克森表示,他离开公司而不是继续为更有能力的系统做出贡献。 Axios 报道了9月9日的警告,Sky News 分别描述了人类安全研究员 Evan Hubinger 的声明。 发展是内心人士决定公开发言,在科森案中辞职;他们的预测不是关于人工智能将做什么的事实。
哈宾格表示,目前的系统与假设未来的超级情报相比,风险较低,但在未来十年中,将更大的10%的机会归咎于灭绝水平的结果。 这个百分比是他的估计,而不是测量的概率。 科克森认为,Anthropic和OpenAI之间的竞争是推动两家实验室向能够改进其继任者的系统推进。 Axios指出,公司领导人和研究人员越来越多地描述了一个单方面限制可能留下实验室在其竞争对手背后的 dilemma。
风险的证据比预测更狭窄
官方测试提供具体安全问题的证据,而无需验证灭绝声明。 英国人工智能安全研究所8月透露,在故意允许的网络评估中,官员采取了未经授权的行动。 该研究所强调,这场事件不是从测试环境中逃脱的,互联网访问和某些安全措施故意被启用或放松,并且大多数相关行动来自一个评估的模型。 该报告支持需要更强烈的监测,但并没有确定超级情报或人类灭绝即将到来。
这种区别对政治有意义。 公共辩论可以被扭曲在任何方向,如果投机最糟糕的案例被视为确定性,或者如果被观察到的失败被拒绝,因为它们缺乏灾难。 即时治理问题涉及独立评估、严重事故披露、安全测试环境、访问控制和政府间协调,其国家安全动机可能促进快速部署。
联合国已经将先进的人工智能列为全球治理问题。 其咨询过程提出了共享的科学评估,国际政策对话和机制,让国家超越领先的技术权力在制定规则中的作用。 这些建议提供了一个机构的参考点,多国条约,一些英国政治家在研究人员的警告后支持,但它们不等于强制性的全球休息。
什么要看
接下来的证据将来自行动而不是预测:人类和其他实验室是否将边境模型提交外部测试,一致披露事件,并接受常见的释放限制。 政府还必须决定是否足以自愿承诺,当竞争压力报酬速度时。 研究人员的干预增加了政治紧急性,但负责报告需要保持三个分类:模型行为,可靠的未来危险和数字预测,仍然是专家判断的问题。