
9月8日,Anthropic研究员Jacob Coxon宣布辞职,并在X平台上发表长文反思人工智能发展。该文章迅速引发全球关注,短时间内阅读量突破3000万次。他在文中强烈批评了OpenAI与Anthropic两大AI实验室的现行策略,称两家公司“都没有在负责任地行事”,并警告AI技术正加速冲向可能颠覆人类文明的超级智能阶段。
Jacob Coxon在推文中透露,过去三年他先后在OpenAI与Anthropic从事预训练研究。他认为,当前AI系统很快将拥有超人级别的能力,包括入侵任意系统、一夜之间颠覆行业格局、获取真实权力与资源。他直言:“不要低估这项技术的力量。”同时指出,许多AI公司高管和资深研究员私下都表达过恐惧,但公开场合却刻意保持理性措辞,这种矛盾令人不安。
针对“既然恐惧为何还要继续建造”的质疑,Coxon分析称,OpenAI内部许多人对文明存亡风险并未真正内化,而Anthropic虽然充分理解风险,却陷入了“抢先抵达”的竞赛逻辑——他们认为若自己不推进,别人也会推进,因此只能冒险承担。Coxon认为,这种把人类文明命运系于少数私人公司Slack频道内部的“终局”决策,是严重的狂妄赌博。
他同时表达了对全球协作的谨慎乐观,提到Hugging Face遭受攻击等警示事件可能促使美国各实验室之间达成“节奏协议”(pacing agreements)。但他坦言,当前轨道无法阻止全球AI竞赛,可能需要更激进的行动,例如暂时禁止模型能力继续提升。
最后,他呼吁AI实验室研究人员认真思考未来数年的实际场景:是否要在尚未深入理解超级智能“心智”的情况下贸然启动其强化学习运行?是否应因“反正都会发生”而继续埋头,抑或抓住此刻呼吁改变现有游戏规则?Jacob Coxon的这篇文章,在AI业界和加密社区引发了对技术失控风险的广泛讨论。
