AI · · 2 min read

OpenAI安全架构师离职,呼吁加强人工智能安全防护

David Robinson的离职及其公开批评,凸显了围绕安全、监管以及先进人工智能系统快速发展的日益加剧的紧张关系。

据Crypto Briefing报道,OpenAI安全研究员David Robinson于2026年10月初离职,此前他已在公司工作三年半。他离职之际在《大西洋》杂志发表了一篇文章,认为各大人工智能实验室加强安全防护的速度,还不足以跟上这项技术的发展步伐。

Robinson曾参与设计OpenAI的准备度框架(Preparedness Framework),这是一套用于评估模型是否可能发展出造成严重风险的能力的内部流程。因此,他的离开所传递的信号比普通的人事变动更为重要:他曾深度参与公司用于评估模型危险行为的核心系统之一。

这篇文章指出,问题并不只是技术控制措施。Robinson认为,大型人工智能公司的文化往往奖励快速发布产品,即使有关可靠性和潜在危害的问题仍未得到解决。他将这种做法与航空和核安全领域进行了对比;在这些行业中,严格的工程标准和谨慎态度至关重要,因为失误可能付出生命代价。

OpenAI内部的安全争论

Robinson的离职发生在OpenAI安全团队经历重大变化之后。2026年7月,公司在研究部门领导层之下重组了这些团队,并将其明确置于副总裁Mia Glaese的职责范围内。一些员工认为这一变化颇具争议。

这一架构可以有两种不同的解读。让安全专家更贴近研究团队,可能使他们更容易接触到开发新系统的人员。但如果让他们归属于负责研究和模型发布的领导层,安全方面的担忧也可能更难压过商业或技术发展的势头。

重组后,数名员工离职。负责安全系统的Johannes Heidecke离开了OpenAI,首席未来学家Joshua Achiam也已离职。10月,公司解雇了三名安全研究员——Jasmine Wang、Tomek Korbak和Mikita Balesni,理由是他们被指控在一次内部调查期间不当处理敏感信息。

这些事件是更长期趋势的一部分。自2024年以来,OpenAI与安全相关的离职事件不断累积,其中包括联合创始人Ilya Sutskever的离开。在这一背景下,Robinson的批评很可能不仅会被视为外部警告,也会被视为公司内部围绕如何在安全防护与开发之间取得平衡而承受压力的又一迹象。

为什么这一框架很重要

OpenAI的准备度框架,是公司公开说明其打算如何识别和管理日益强大的模型所带来风险的主要文件之一。Robinson参与创建了这一框架,因此他的批评格外具有相关性:他在帮助建立应对这一挑战的机制之一后,如今正在质疑整个行业。

Crypto Briefing报道称,OpenAI还因其对先进模型的处理方式而面临批评,并已暂停原定推出的GPT-6.1 Astra。文章并未证明Robinson的辞职导致了这次暂停,但这两项进展再次引发关注:对于下一代系统而言,公司现有的安全流程是否足够。

对OpenAI而言,眼下的问题是可信度。只有当外界认为公司愿意遵守这一框架、赋予安全团队实质性权力,并在采取行动会延迟发布时仍能根据警告采取措施,这一框架才能让公众放心。近期的组织架构调整和员工离职,让公司更难回答这一问题。

从内部批评走向监管

Robinson并不是简单地离开这场争论。据报道,他正与公共关系公司Spitfire Strategies合作,推动加强人工智能监管,并向各实验室施加外部压力,促使它们更加认真地对待安全问题。

这一举动指向其论点中更广泛的一项担忧:如果企业面临超越竞争对手的强烈激励,仅靠自愿采取的安全防护措施可能并不足够。如果政策制定者认为各大实验室无法可靠地自我监管,外部规则和监督的作用可能会更加突出。

接下来的发展将有助于判断Robinson的警告能否引发更大反响。OpenAI可能会公开回应他在《大西洋》杂志发表的文章,说明其安全团队如今如何运作,或提供有关GPT-6.1 Astra的最新进展。若安全团队进一步有人离职,将更加加深外界对这样一种未解决冲突的印象:模型快速开发与独立风险管理之间存在矛盾。

artificial intelligenceopenaiai safetytechnology regulationmachine learningcorporate governance

Continue reading

Read this in another language