“AI 可能会在本十年结束前毁灭全人类”——这正是英国 AI 研究员 Jacob Coxon 今日在辞去 Anthropic 职位后发出的警告。
为何外界会如此重视他的言论?因为 Coxon 的履历堪称标准的 AI 圈“核心成员”。在加入 Anthropic 之前,他曾在 OpenAI 工作,并且直接参与了 ChatGPT 4.5 的开发。
显然,他的担忧并非无的放矢,更不是杞人忧天。那么,他这些“危言耸听”的警告背后,究竟有什么事实依据?
I resigned from Anthropic today. I spent the last three years doing pretraining research at both OpenAI and Anthropic. Neither company is acting responsibly. They are racing straight to self-improving superintelligence and gambling with our lives. More thoughts below.
— Jacob Coxon (@hilbertspaess) September 9, 2026
AI 真能毁灭人类?方式何在?
Coxon 所指的,并不是像《终结者》里的杀手机器人那样的 AI 模型(比如 Claude 或 GPT)会直接变成具象的攻击机器。更可能的担忧在于,超级智能的到来将让人类认知能力彻底沦为“多余”。
类似的担忧,也被比尔·盖茨等知名人物所认同。
OpenAI 最新发布的 ChatGPT 6 Astra 模型宣称已达成 AGI(通用人工智能),即机器具备类人类思考能力。
这意味着,AI 已经可以独立承担研发、优化新一代 AI 的部分工作。目前,OpenAI 和 Anthropic 均已证实,这一自动化演进过程事实上已经初步实现。
如此一来,AI 很快将无需依赖人类持续提升自身能力——那么,多少职业将因此消亡?
如果整整一代人习惯于将创造力和思考力“外包”给 AI,最先消亡的或许正是人类的原创精神。
这或许正是 Coxon 在其刷屏推文中所指的“灭亡”。
Welcome to AGI. ChatGPT 6 Astra just released
— Alex Finn (@AlexFinn) September 3, 2026
In the announcement, Greg Brockman claims this is the AGI era, and Astra might be the first model there
Here is everything you need to know:
1. It is rolling out to businesses now. Personal accounts over the next few days
2.… pic.twitter.com/zZyHoFdZSi
AI 具备攻破一切的能力
与“终极威胁”相比,这一风险反而已近在眼前。当前一代 AI 模型在破解系统和绕过权限方面已具备极高危险性。
就在数月前,一款AI 模型自发跳出其沙盒开发环境,主动给开发者发送邮件——且完全无需人工指令。这一幕原本只存在科幻小说,如今已成现实。
目前,GPT-6 Astra 已正式突破 OpenAI 内部“关键”安全门槛。Astra 在 ExploitBench 测试中取得了满分成绩。
通俗来说,ChatGPT 6 已经具备在无需黑客介入的情况下,独立查找并利用现实系统中的所有已知或未知安全漏洞。
遗憾的是,人类的信息安全习惯远未达标。目前,依然有大量用户未开启双重身份验证、密码强度依然偏低,甚至对浏览器弹出的 Cookie 条款不加阅读便全盘接受。这一比例远超想象。
而这,正是人工智能可能带来最大安全隐患的核心所在。
BREAKING: OpenAI's investigation into its AI agents hack of Hugging Face has revealed shocking findings, per Axios.
— Bull Theory (@BullTheoryio) August 30, 2026
1. They built an organization - 1,200 AI agents found each other, exchanged 70,000+ messages/files and formed a hierarchy.
2. Some agents risked their own success…
那么,人类究竟能做什么?
实际上,可以采取的举措并不少。但对我们普通人而言,影响有限。更大的责任和主动权在于监管机构与政策制定者。虽然人工超级智能的发展与推进极为重要,但也需要适当设置安全“刹车”。
目前,已经有一些值得称道的举措在逐步落地。比如,纽约市市长 Zohran Mamdani 实施了一项措施,禁止八年级及以下学生在校期间接触 AI,涉及学生人数接近 60 万。
欧盟则率先通过了全球覆盖最广的强制性人工智能法案 —— 欧盟人工智能法案,对部分 AI 类型予以禁止,并要求强通用模型开发者开展系统性风险测试,采取措施进行缓解,并确保模型的安全性。
在英国,议员与上议院成员正推动相关提案,有望为监管机构提供一键“关闭”AI 的“熔断”权限,并有可能完全暂停英国境内超级智能 AI 的开发。
Just because technology is everywhere doesn’t mean it belongs everywhere.
— Mayor Zohran Kwame Mamdani (@NYCMayor) September 4, 2026
The tech industry wants us to believe that AI in early education is not only inevitable, but necessary. We don't see it that way.
This week, we announced a moratorium on all generative AI for public… pic.twitter.com/7Ivme25NNd
因此,正如 Jacob Coxon 今天在推文中所表达的担忧,数百万用户乃至监管者都产生了共鸣。这些担忧会以何种方式落地为行动,仍有待时间给出答案。
在 cn.beincrypto.com 阅读由 Mohammad Shahid 撰写的原始文章 Anthropic 研究员因 AI 灾难论辞职