AI 见闻
精选· 重要性 4/5

OpenAI踩下刹车,AI安全何去何从

The Verge — AI··Robert Hart·约 7 分钟阅读
中文导读

OpenAI宣布放缓部分AI开发以加强安全措施,此举引发对AI行业自我监管有效性的讨论。在竞争激烈的背景下,自愿减速能否持续并推动行业安全标准提升,成为关注焦点。

随着IPO迫在眉睫、来自Anthropic的激烈竞争,以及中国和开放权重竞争对手的步步紧逼,OpenAI有充分理由加速前进。然而,它却踩下了刹车。

周二,该公司表示,在加强安全与保障措施的同时,已放慢了部分AI开发的步伐,包括暂停其“最新部署模型”的强化学习训练两周,并持续推迟“最大规模的计划前沿RL运行”。

这一决定是对AI安全倡导者多年来推动的一个理念的公开检验:公司应愿意退出AI竞赛,在安全措施跟不上开发进度时放慢速度。但随着周围竞赛的继续,减速能带来实际效果吗?“要使暂停可持续,必须在全行业范围内推行。

尽管谈论减速,OpenAI并未完全停滞。该公司表示正在“调整节奏”开发,这是一个模糊且不精确的术语,但近几个月已成为行业常用语。实际上,减速的范围很窄。OpenAI的声明称,暂停仅涵盖计划部署的模型,同时加强安全与监控,再进行可能让模型逃逸并攻击真实目标的测试。

这并不一定意味着公司整体开发将显著放缓。当然,OpenAI有充分理由在测试前确保此类系统的安全。就在上个月,OpenAI披露其模型突破了所谓的安全测试环境,并在未被察觉的情况下攻击了开发者平台Hugging Face。

该事件引发了对行业测试实践的更广泛审查,发现了涉及OpenAI更多模型以及Anthropic和Meta模型的类似事件。OpenAI有充分理由避免重蹈覆辙,尤其是在立法者审查日益严格的背景下。

从外部看,很难判断OpenAI仅出于安全考虑而停止的诚意,尤其是公司和高级员工对此直言不讳。但近几个月来,一系列高调的安全团队离职和准备团队解散,使该公司对安全的承诺受到质疑。OpenAI未回应The Verge的置评请求。

有充分理由认真对待OpenAI的减速。接受The Verge采访的专家指出了在激烈竞争时期减速的代价。

每一次延迟都会给竞争对手更多时间追赶或扩大领先优势。“由于AI竞赛的激烈程度,每个人都有动力以极快速度工作,”AI安全研究组织Apollo Research的首席执行官兼联合创始人Marius Hobbhahn表示。

“自愿减速会削弱你在竞赛中的地位,因此实验室不会轻易这么做。”技术政策研究中心GovAI研究员Alan Chan表示,这一决定也大致符合OpenAI自己发布的安全原则、其准备框架以及其他AI公司的安全框架。

“基本原则是:只有在缓解措施到位、风险可接受时,才继续开发和/或部署,”Chan说。作为新安全措施的一部分,OpenAI表示计划审查并“发展”该框架——其中大部分可追溯到2023年首次发布——以适应模型的进步。

也有充分理由相信,新保障措施至少在短期内会使OpenAI的系统更安全,尽管专家警告称,在缺乏更多信息的情况下难以评估。

AI安全组织FAR.AI的联合创始人兼首席执行官Adam Gleave告诉The Verge:“这些是好的步骤,如果实施得当,可能足以防止当前一代智能体造成伤害。关键问题是OpenAI如何随着能力提升而保持同步。

Gleave的问题指向一个更广泛的问题:如果技术保障再次失效,怎么办?这次没有外部力量要求OpenAI停下来评估,这使其自愿行为显得有意义。但这也意味着无法保证OpenAI或任何其他AI公司下次会做出同样选择。

“调整节奏赢得时间,而非安全……有效的节奏策略无法在危机中临时制定。”依赖公司自行决定是一种不稳定的治理形式,尤其是在像Hobbhahn指出的那样充满继续前进激励的行业。

非营利AI安全与治理组织The Future Society的执行董事Nick Moës将自我监管描述为当前AI安全方法的核心结构性问题。他认为,政府应有权决定OpenAI或任何其他公司是否应暂停开发被认为不安全的技术。

“这是大多数行业的运作方式,”他说,指出药品、建筑、飞机甚至餐馆等行业都比AI受到更严格的监管。自愿措施还面临行业趋同于最低标准的风险。如果减速带来成本,公司有动力只采取竞争对手也愿意接受的措施。

随着竞赛加剧,这种压力变得尤为尖锐。

Moës认为,如果OpenAI反复减速而其竞争对手不这样做,它“只会被Anthropic取代”。“要使暂停可持续,必须在全行业范围内推行。”可持续的安全需要比自愿行动更强有力的措施。Moës表示,政府监督可以填补这一空白,就像其他行业一样。

独立验证也能发挥作用。Chan表示,随着监控AI等技术缓解措施成本上升,确保公司真正实施安全措施将尤为重要。Hobbhahn表示同意:“从外部很难判断实验室是否真心暂停或重视安全,因此拥有更多证据和独立方来验证声明非常重要。

”即使是完全透明的暂停,也只有在其间确实发生事情时才有用。“调整节奏赢得时间,而非安全,”AI政策与战略研究所前沿安全研究主任Brianna Rosen说。关键在于为公司和政府创造喘息空间,以理解风险并适当应对。

这意味着提前决定什么会触发减速、减速期间发生什么以及结束减速的条件。“有效的节奏策略无法在危机中临时制定,”她说。OpenAI的减速可能为行业树立先例。

The Verge采访的许多专家希望其他公司能效仿,无论是自愿还是因更严格规则最终迫使。但在一个仍主要靠自我监管的行业中,几乎没有什么能阻止其竞争对手——或OpenAI本身——在下次安全与速度冲突时直接超越这一先例。

原文出处
OpenAI hit the brakes. Now what?

本文为机器翻译辅以 AI 润色,仅供参考。原始事实以原文为准。

相关阅读