Anthropic 研究员离职 警告 AI 实验室存安全担忧

BeInCrypto
Abrir em BeInCrypto
Anthropic 研究员离职 警告 AI 实验室存安全担忧

Anthropic 研究员 Jacob Coxon 宣布从公司辞职,并指控 Anthropic 及 OpenAI 正在竞相向自我进化的超级智能推进,赌上了人类的未来。

这位研究员表示,过去三年,他分别在两家公司负责前期训练相关工作。他在 X 平台连发多条帖文,披露相关指控。

Anthropic 研究员离职,向内部员工发出严峻警告

Coxon 认为,业界对这项技术进化的速度普遍低估。他声称,下一代系统将能够攻破任何防护、彻底重塑各行各业,并获得实际的权力与资源。

他还指出,行业内部的私下讨论与对外表态存在巨大落差。据 Coxon 透露,高层在公开场合会有意弱化措辞,私下却表达出极大的担忧。

“真正投身 AI 研发的人,很多都相信,人工智能到本世纪末可能让全人类覆灭。这绝非营销噱头,”他表示。“没有任何人类活动具备如此巨大的风险。”

Coxon 也比较了自己供职过的两家公司。他表示,OpenAI 内部许多人尚未充分意识到这背后的“文明风险”,而 Anthropic 虽然有清醒认知,却依旧深陷竞争,只为率先抵达目标。

Jacob is correct here—we really do earnestly believe AI could kill all humans! I personally think it is >10% within the next decade. I believe Anthropic is trying its best, but we do not yet have a plan to solve alignment for superintelligence and are not clearly on track to. https://t.co/QAIHiFP3QZ

— Evan Hubinger (@EvanHub) September 9, 2026

今年以来,已有多位员工与管理层分道扬镳。Anthropic 的安全负责人 Mrinank Sharma 已于 2 月份辞职。

OpenAI 前首席未来学家 Joshua Achiam 也于 9 月 1 日发帖称,失控的 AI 系统未来将自发扩散,并主动追逐金钱与权力。

关注我们的 X 账号,实时掌握区块链最新动态

行业呼吁加强协调

Coxon 表示,如今 AI 正迈入所谓“终局阶段”,但这是一场极具风险的豪赌。他认为,这样的决定“不应仅凭一家公司在 Slack 里的对话就轻易作出”。

尽管如此,他还是对行业的协调表达乐观态度。他提到,Hugging Face 遭遇黑客攻击事件已推动美国各大 AI 实验室之间的进度协调协议更有可能落地。

两家公司此前均已支持类似倡议。今年 7 月,逾 1,100 名前沿人工智能实验室员工签署了“控制人工智能前沿”联名信,其中包括 Anthropic 首席执行官 Dario Amodei 与 OpenAI 首席科学家 Jakub Pachocki。

“我们呼吁美国政府支持推动国际合作,开发必要的技术与治理工具,以有序引导自动化人工智能发展的前沿进程。”信中如是写道。

此外,这两家公司还与 Google、微软及约 150 家组织共同签署了关于网络安全防御的公开联名信。信中警告称,AI 驱动的网络攻击将在未来数月变得更加普遍与复杂。

值得注意的是,Coxon 发布警告的时间,也正值联合国人权事务高级专员 Volker Türk 向人权理事会表示,先进人工智能已可能带来“生存威胁”。

Coxon 还补充表示,若要防止全球范围内的 AI 军备竞赛,或许需要暂时禁止提升模型能力的相关研发工作。他最后呼吁实验室研究人员,在未充分理解相关系统之前,应慎重考虑是否启动超级智能强化学习的探索。

BeInCrypto 已就此事向 Anthropic 与 OpenAI 寻求置评。

点击订阅我们的 YouTube 频道,获取业内领袖与资深记者的深度解读

https://youtu.be/2_JJv4gIQt0

在 cn.beincrypto.com 阅读由 Kamina Bashir 撰写的原始文章 Anthropic 研究员离职 警告 AI 实验室存安全担忧