一个27岁的AI研究员从Anthropic辞职了,因为他担心AI会导致人类灭绝。
数字生命卡兹克·2026-09-10 08:09

核心观点 - 前OpenAI和Anthropic员工Jacob Coxon辞职并警告,前沿AI公司正朝着能够自我改进的超级智能狂奔,可能在本十年结束前导致人类灭绝[1] - 文章引用2015年Tim Urban的《人工智能革命》观点,认为超级智能将把人类文明推向灭绝或永生两个极端,没有中间解[11][35] 行业人物与背景 - Jacob Coxon,27岁,英国数学背景,2016和2017年连续进入英国国际数学奥林匹克竞赛队伍,后进入剑桥大学Trinity College学数学[3] - 2021年参与eLife医学统计论文,2023年加入OpenAI,是GPT-4o官方贡献者,GPT-4.5核心贡献者[3] - 今年从OpenAI跳槽至Anthropic从事预训练,不久后辞职,甚至考虑彻底离开AI行业[3] - Anthropic对齐负责人公开支持Jacob,认为10年内发生概率大于10%[3] - Anthropic安全研究员工以个人身份支持Jacob[3] - 刚离开Anthropic、负责可扩展监督的Joe Benton,也确认Jacob对行业现状的描述准确[4] 行业内部认知 - 在AI公司内部,职位越高的人往往越担心超级智能风险[4] - 真正参与制造前沿AI的人中,有不少私下相信若失控,人类可能在本十年结束前灭绝[1] 技术发展现状与趋势 - 2022年ChatGPT出现,2023年GPT-4多模态大模型,随后o1推理模型、Claude Code、Codex、Agent接连出现[15] - 上周GPT-6 Astra已能像人一样操作电脑,在陌生软件中找按钮、试错并持续工作数小时[16] - 2026年5月,一个OpenAI模型推翻研究了80年的Erdős离散几何猜想[16] - 2026年9月4日,Anthropic用Claude花11天将费马大定理变成1300万行可被计算机检查的形式化证明,人类原估计需十年[16] - OpenAI极限88小时解决千禧年难题[16] - 2026年2月,OpenAI在GPT-5.3 Codex发布时称,这是第一个在创造自己过程中发挥关键作用的模型[16] - 几乎所有强模型在训练阶段已有AI参与[16] 智能爆炸与递归自我改进 - 文章引用Tim Urban的“智能阶梯”概念,认为人类与超级智能的差距可能像黑猩猩与人类,甚至像人类与蚂蚁[19][20][21][22] - 若AI达到顶级AI研究员水平,其最有价值的工作之一是继续研究更聪明的AI,形成正反馈循环[25][26][27][28][29] - 2026年,最原始的反馈回路已在各模型厂子形成,GPT-6虽不会自己造出GPT-7,但逻辑链最早几环已可见[29] - 更聪明的AI创造更大经济价值,吸引更多资本购买更多GPU,训练更强AI,公司间和国家间竞争加剧,整个文明像越来越陡的河[30] 文明尺度与终极赌局 - 文章引用Nick Bostrom概念,认为灭绝是地球物种的吸引子状态,超级智能可能首次打开“物种永生”这一吸引子[30] - 人类走在平衡木上,小行星、瘟疫、战争或自己创造的技术可能将人类撞下[31] - 超级智能出现后可能经历最狠的撞击,一边是灭绝,另一边是地球生命从未抵达的永生[33][34][35] - AI已开始参与数学发现、药物研发、人类基因组分析、新材料研究、操作实验和软件,加速人类世界一切[37] - 若AI帮助人类跨过几百万年来无物种能跨过的平衡木,让生命摆脱疾病、衰老、随机灾难和死亡,将成为人类历史上最伟大的事情[38][39]

一个27岁的AI研究员从Anthropic辞职了,因为他担心AI会导致人类灭绝。 - Reportify