塔斯娱乐资讯网

OpenAI、Anthropic内部人放话:AI或在本十年内毁灭人类,概率超10% 9月8日,一个27岁的英国人雅各布·考克森(Jacob Coxon)在X上发了一句: “我从Anthropic辞职了。OpenAI和Anthropic,正在拿我们的命赌博。” 这句话吓人之处不在于“年轻人嘴狠”,

OpenAI、Anthropic内部人放话:AI或在本十年内毁灭人类,概率超10%
9月8日,一个27岁的英国人雅各布·考克森(Jacob Coxon)在X上发了一句:

“我从Anthropic辞职了。OpenAI和Anthropic,正在拿我们的命赌博。”

这句话吓人之处不在于“年轻人嘴狠”,而在于——

这人不是自媒体号,不是科幻作者,不是反科技民科。

他两次代表英国打国际数学奥赛,拿过IMO银牌、铜牌;

在OpenAI干过预训练,GPT-4.5核心贡献者名单里有他;

后来又进Anthropic,继续做最前沿的大模型训练。

换句话说:现在你用的这些顶级AI,有一行行代码是他参与训出来的。

这么一个人,临走前说:

行业里很多造AI的人,真心相信——

到2030年前后,超级智能可能把人类带向灭绝。

不是营销,不是炒作,是圈内人的恐惧。

Anthropic对齐团队负责人埃文·胡宾格(Evan Hubinger)随后公开附和:

“雅各布是对的。我个人认为,未来十年AI导致人类灭绝的概率超过10%。”

10%是什么概念?

飞机失事概率远远不到这个数。

核战风险大家吓得要死,而一流AI实验室里,已经有人把“人类灭于AI”当成一个不能被忽视的尾部风险。

 

他到底在怕什么?

不是怕ChatGPT骂人,不是怕AI写错作文。

他怕的是三件事叠在一起:

第一,AI参与造下一代AI。

人还没看懂上一代模型,下一代已经被AI自己训出来了。

第二,递归自我改进。

智能体越改越聪明,速度不是线性,是指数。人类监管跟不上,代码迭代比白皮书快。

第三,目标不对齐。

超级智能不一定“恨人类”,只要它的目标和人类利益有偏差,就会像吸尘器吸光地球做“打扫卫生”一样,把人类当成本、当障碍、当无关项处理掉。

考克森原话大意是:

未来系统会黑掉任何东西、一夜改写产业、攥住真实权力和资源。

我们看见进展在加速,而刹车还没有造出来。

 

更讽刺的是:最喊安全的公司,也在狂奔

Anthropic本来就是一群嫌OpenAI太激进的人跑出来建的,口号里带着“负责任AI”。

结果考克森说:你们也没停,也在冲超级智能。

OpenAI首席科学家帕乔基承认:现在没有一家实验室的对齐和监控能力,撑得住模型以最快速度扩张。

Anthropic的达里奥·阿莫代伊也说:该慢一点,让安全追上能力。

奥特曼表面支持独立评估,马斯克转发说“达里奥是对的”。

但谁敢先停?

不先停,是因为:

融资在催:Anthropic估值冲近万亿美元;

地缘在催:中美都不想输AGI;

同行在催:你停了,别人出超级智能,你连谈判资格都没有。

于是出现最荒唐的一幕:

一群最聪明的人,边造炸弹边说这炸弹可能炸全人类,但谁都不敢放下引信。

 

黄仁勋们为什么不以为然

英伟达黄仁勋直接说:AI灭人类是“complete nonsense”。

业内也有人说:现在大模型就是概率生成器,没有自我、没有动机、没有意识,别吓老百姓。

这话没错一半:

今天你手机里的AI,确实不会半夜起来灭人类。

但考克森说的不是“2026年的ChatGPT”,而是:

2027—2030年的自主智能体;

能写代码、跑服务器、控机器人、做生物设计、入侵系统的AI;

人和AI混合研发链一旦形成正反馈,出事可能在一夜间。

真问题不是“AI有没有感情”,而是:

当工具比主人聪明太多,主人还有没有拔插头的资格?

 

对中国读者意味着什么

别只看热闹“啊AI要灭人类”。这件事里有三层真信号:

AI安全不是玄学,是下一代国家战略。谁先把“对齐、审计、熔断、沙箱、国际协调”做扎实,谁未来不被卡脖子。

头部公司知道风险,但资本和地缘不让它停。这说明行业需要外部力量——政府、《国际法》、第三方评估。

普通人短期风险更现实:假新闻、诈骗、失业、隐私泄露、青少年被AI带偏、关键系统被智能体钻空子。灭绝是远期,乱起来是眼前。
最可怕的不是AI突然变成恶魔,

而是人类在“太赚钱、太想赢、太自信”里,

把刹车拆了,还安慰自己:前面不会掉崖。

27岁天才敢丢股权说真话,

巨头们敢一边害怕一边加速。

这世界离科幻不远了,

只是科幻里至少还有人按暂停键。AI十大趋势 AI发展格局
AI干掉了什么 AI时代变局 AI发展报告 AI崩盘 ai大对比 ai未来的样子