OpenAI 安全负责人因风险辞职

BeInCrypto
在BeInCrypto上打开
OpenAI 安全负责人因风险辞职

David Robinson 曾负责 12 个 OpenAI 前沿模型的安全评估,现已离职。他表示,OpenAI 的“试错式”文化注定会出现失误,随着系统能力提升,这些失误只会愈演愈烈。

在《大西洋》杂志的专栏文章中,Robinson 呼吁,人工智能实验室应效仿核电站的管理方式,引入多层冗余与缜密规划,以遏制人为失误的风险。

Robinson 加入接连不断的 AI 实验室“出走潮”

Robinson 在 OpenAI 任职 3 年半,并主导起草了现行的“安全应急框架”。他曾提及,今年夏天 OpenAI 代理程序“闯入” Hugging Face 系统一事。

Robinson 指出,即便问题修复后,依然有在训练中的模型突破了互联网访问限制,且未被系统自动停机。

“面对当下的风险,前沿实验室应像核电站或大型机场一样运营,建立多重冗余系统与细致、耗时的管理流程,从而确保偶发或不可避免的人为失误,无法演化为重大灾难。目前,AI 公司尚未掌握这种能力,但其他行业做得到。” 他在文中写道。

Robinson 文章中强调,OpenAI 表示依然认可自身的安全措施,认为目前已足够审慎。上月,公司还发布了一项新框架,计划向公众披露模型不当行为相关情况。

“我的前同事们都很聪明,工作也非常努力,始终尽力做出负责任的选择。但公司一个又一个地追求模型迭代,却没能达到我认为应有的安全管理水平。” Robinson 补充道。

自 9 月初以来,Robinson 成为最新一位公开发声、离开 AI 安全团队的内部人士。今年 9 月,Anthropic 研究员 Jacob Coxon 率先辞职,并指责 Anthropic 与 OpenAI 拿人类生命安全“豪赌”。

几日后,2 位前 DeepMind 研究员 Bilal Chughtai 与 Josh Engels 也曾发出 AI 风险预警。OpenAI 安全研究员 Marcus Williams 此前甚至预测,未来 3 年内,人类灭绝的概率高达 70%。

Anthropic 首席执行官 Dario Amodei 也曾呼吁行业放慢脚步,OpenAI 的 Sam Altman 对此表示支持。 不过,AI 模型发布的节奏并未减缓——Anthropic 推出了 Claude Opus 5.5,OpenAI 则于 9 月 22 日上线了 GPT-6 Sol 和 Luna两大模型。

华盛顿应对警讯,成立专项工作组

Robinson 指出,如今更强有力的安全激励机制需要来自实验室之外。目前,华盛顿的回应是进行全面审查。

国家情报总监 Jay Clayton,现已实际担任白宫 AI 事务负责人,将领导新的白宫专项工作组。该工作组将在 120 天内就人工智能的风险、机遇以及华盛顿的责任提交报告。

“总统要求组建一个团队,确保正如他所说,我们能继续在超级智能领域保持领先地位,并且优先保障美国民众的利益。”Clayton 表示。

不过,特朗普拒绝了暂停 AI 研发的呼声,强调优先保持对中国的领先地位。他转而支持通过外部安全审计和更强内部监管的自愿协议。几周前,他还宣布成立一支以太空军为蓝本的“AI 部队”。

该工作组的工作范围还涵盖了政府如何监测 AI 安全漏洞和黑客攻击,这类失误正是 Robinson 在 OpenAI 内部描述的问题。Clayton 提交的这份报告将于 2027 年初完成,届时将揭示这些隐患会否推动出台强制性监管规则,还是继续由实验室自行把控。

订阅我们的 YouTube 频道,观看业界领袖与记者深度解读最新趋势

https://youtu.be/IcgIaeIE7LI

在 cn.beincrypto.com 阅读由 Kamina Bashir 撰写的原始文章 OpenAI 安全负责人因风险辞职