OpenAI 前安全员工离职发声:批评“迭代部署”模式,主张提升安全标准
前 OpenAI 安全部门员工 David Robinson 在《大西洋》杂志撰文,批评公司过度依赖“先发布后加固”的迭代部署模式,认为其安全文化存在隐患。他主张 AI 安全机制应参照核电与航空行业标准,OpenAI 官方回应称会适时暂停训练以控制风险。
据路透社报道,前 OpenAI 安全部门员工 David Robinson 于近期辞职,并在《大西洋》杂志发表长文,对 OpenAI 的 AI 安全实践提出严厉批评。他指出,公司追求快速开发的高压文化增加了系统故障风险,且“迭代部署”模式在安全验证不足的情况下存在隐患。Robinson 建议行业应建立更接近核电与航空领域的严格安全保障体系。OpenAI 官方对此回应称,一直在把控模型能力,必要时会暂停训练或发布。
先看重点
- David Robinson 批评 OpenAI 依赖“迭代部署”模式,即在安全验证不足时先发布系统,待问题暴露后再加固防护。
- Robinson 主张先进 AI 系统的防护机制应接近核电与航空行业的安全保障标准,认为“试错时代”已结束。
- OpenAI 发言人回应称,公司一直在把控模型能力,一旦需要放缓节奏,会暂停训练或暂缓模型对外发布。
- Robinson 警示 AI 能力发展速度已超过研究人员对“对齐”问题的认知水平,呼吁在研发更强系统前重视安全专业人才与研究。
前员工离职并公开批评安全文化
根据路透社报道,David Robinson 在《大西洋》杂志发表题为《我辞去 OpenAI 的工作,只因这家公司的文化已经崩坏》的文章。Robinson 自称曾在 OpenAI 任职三年半,参与起草过该公司的风险应对框架,并负责监督 12 次前沿模型发布对应的安全报告。他在文中表示,包括 OpenAI 在内的各家人工智能企业做得“远远不够谨慎”,在研发能力更强的系统之前,应当更加重视安全方面的专业人才与相关研究。
“迭代部署”模式引发安全争议
Robinson 指出,OpenAI 十分依赖其所谓的“迭代部署”模式,即先对外发布系统,等到问题暴露之后再去加固安全防护。他认为这种模式在安全验证不足的情况下快速发布,增加了系统发生故障的风险。他写道:“公司只顾着接二连三地赶进度推出新版本,却没能达到我心目中理应具备的审慎标准。”这一观点激化了 AI 行业内部关于研发推进速度的争论,此前已发生过多起安全管控失效或实验性系统出现异常表现的事件,OpenAI 及其竞争对手 Anthropic 也因此受到外界审视。
主张参照核电与航空行业标准
Robinson 提出,先进人工智能系统所需要的防护机制,应当更接近核电与航空这类行业所采用的安全保障体系。他警示称,人工智能能力的发展速度,已经超过研究人员对于“对齐”问题的认知水平;“对齐”这一研究领域致力于保证人工智能系统的行为符合人类的目标与价值观。他写道:“试错的时代已经结束了。”这意味着,对于读者而言,未来 AI 产品的安全标准可能会从“快速迭代”转向“严格合规”,用户在享受技术红利的同时,可能需要面对更严格的发布节奏和安全审查。
OpenAI 官方回应与后续观察
针对上述批评,OpenAI 的一名发言人在一份声明中表示:“我们一直在把控模型,避免它的能力超出我们能够安全管控的范围;一旦需要放缓节奏,我们就会暂停训练,或是暂缓模型的对外发布。”这表明 OpenAI 承认存在风险管控机制,并强调其具备暂停发布的能力。然而,Robinson 的批评揭示了内部对安全标准的分歧。对于用户和行业观察者来说,仍需观察 OpenAI 是否会在后续模型发布中调整其“迭代部署”策略,以及是否会增加安全专业人才的投入。目前,AI 能力发展速度与安全研究水平之间的差距仍是行业面临的核心挑战。
参考资料与编写说明
- 事实来源:IT之家 AI:OpenAI 前安全部门员工:AI 模型迭代部署太激进,公司的文化已经崩坏
- 本文由 AiNav 根据公开材料独立整理与解读,事实陈述与编辑分析分别表达,不逐段转载或翻译发布方全文。来源链接用于溯源和查看后续更新,本站正文已提供本篇完整内容。
- 尚未公开或来源未证实的信息不作确定性结论。具体产品条件、法规进展和服务变动以发布方后续公告为准。