【TechWeb】9月10日消息,一位名叫Jacob Coxon的27岁英国AI研究员9月9日在社交平台X上发布了一则离职声明,迅速引爆了整个AI行业。Coxon宣布从Anthropic辞职,并公开警告:OpenAI和Anthropic两家公司正“拿全人类的生命下注”,在开发自我改进型超级智能的竞赛中均未负责任行事。这则声明在短时间内获得了超过1亿次浏览,成为本周AI领域最受关注的事件之一。
据Coxon在X上的声明,他过去三年先后在OpenAI和Anthropic从事大模型预训练研究。他于2023年加入OpenAI技术团队,2026年7月转赴Anthropic担任研究员,在OpenAI期间曾参与GPT-4o的研发,并被列为该模型系统卡的核心贡献者之一。然而,在Anthropic工作仅约两个月后,他便决定离开,并且宣布退出AI行业。
在离职声明中,Coxon的措辞异常严厉。他写道:“两家公司的做法都不负责任。它们争相开发能够自我改进的超级智能,拿我们的生命下注。”他进一步警告,相关AI系统很快将具备“超人类”能力,能够实施黑客攻击、在一夜之间改变某个领域的格局,并获取真实世界中的权力与资源。
Coxon还揭示了行业内存在的一种深层矛盾:AI从业者私下里真诚地相信AI“可能在本世纪末杀死我们所有人”,但为了在媒体面前显得理性,许多高管和资深研究人员反而会把话说得更委婉。他对两家公司的内部文化做出了区分——在OpenAI,许多员工并未真正认识到这场竞赛关乎人类文明的命运;而在Anthropic,人们清楚这些风险,却陷入了争抢第一的竞赛,其逻辑是“别人都不会负责任地行事,因此即便冒着风险,也必须由自己来实现超级智能”。
Coxon还特别指出,在Anthropic内部,关键决策往往只在私营公司的Slack中完成,不应如此。他呼吁美国头部AI实验室建立能力开发的节奏协议,必要时暂时停止继续提升模型能力。
马斯克下场回应与影响力质疑
这则声明最初由X用户@XFreeze转发,该用户公开质疑:“Anthropic有没有人出来确认一下,这个人真的是你们的人吗?”马斯克随即在该帖下方回复,确认了Coxon的工作经历,但同时指出:“他确实在那里工作过,但只待了几个月。”
然而,随着Coxon帖子的传播数据不断攀升,一位追踪者统计其浏览量超过1.23亿次、点赞超过65.6万、新增关注者超过19万。马斯克又对这一数据的真实性表示了怀疑,称他不相信一个此前几乎没有发帖记录的新账号能获得如此高的互动量。
围绕Coxon的争议不止于此。有调查研究者指出,Coxon的帖子发布时间与《华尔街日报》引用其声明的独家报道仅相隔18分钟,这暗示着与媒体的提前协调,而非临时的自发决定。此外,最早转推Coxon帖子的三个账号分别来自Encode AI、AI政策网络和AI Futures Project三家AI政策倡导组织,其背后的资金来源被追溯至Skype联合创始人、Anthropic投资人Jaan Tallinn资助的生存与繁荣基金。
Anthropic安全负责人公开认同
Coxon的指控在Anthropic内部引发了罕见公开反应。Anthropic对齐科学负责人Evan Hubinger以个人身份在X上回应,表示“雅各布说得对”。他认同Coxon的核心判断,并称自己认为未来十年内AI导致人类灭绝的概率超过10%。
Hubinger同时坦承,Anthropic目前还没有解决超级智能对齐问题的明确方案,也不能确定公司正走在正确的方向上。他指出,Anthropic对现有模型的风险判断仍然较低,但真正令人担忧的是AI参与下一代AI研发后,可能形成越来越快的能力迭代。
Anthropic自身的安全政策也在随着竞争环境变化而调整。2023年,Anthropic推出“负责任扩展政策”,曾承诺在缺少相应安全措施的情况下,不训练或部署突破风险门槛的模型。这条红线一度成为Anthropic区别于其他大模型公司的主要标志。
然而,2026年2月,Anthropic对该政策进行了大幅调整。新版政策继续保留风险报告、模型评估和外部审查,却不再无条件承诺在防护措施不足时停止训练。Anthropic首席科学官Jared Kaplan当时表示,如果竞争对手仍在继续推进,Anthropic单方面停止训练并不能让世界更加安全。
与此同时,Anthropic正筹备于10月中旬进行首次公开募股。在这一背景下,一位内部研究员的公开辞职和安全团队负责人的公开认同,无疑给公司的上市前景蒙上了一层阴影。


