OpenAI、Anthropic内部人放话:AI或在本十年内毁灭人类,概率超10%
9月8日,一个27岁的英国人雅各布·考克森(Jacob Coxon)在X上发了一句:
“我从Anthropic辞职了。OpenAI和Anthropic,正在拿我们的命赌博。”
这句话吓人之处不在于“年轻人嘴狠”,而在于——
这人不是自媒体号,不是科幻作者,不是反科技民科。
他两次代表英国打国际数学奥赛,拿过IMO银牌、铜牌;
在OpenAI干过预训练,GPT-4.5核心贡献者名单里有他;
后来又进Anthropic,继续做最前沿的大模型训练。
换句话说:现在你用的这些顶级AI,有一行行代码是他参与训出来的。
这么一个人,临走前说:
行业里很多造AI的人,真心相信——
到2030年前后,超级智能可能把人类带向灭绝。
不是营销,不是炒作,是圈内人的恐惧。
Anthropic对齐团队负责人埃文·胡宾格(Evan Hubinger)随后公开附和:
“雅各布是对的。我个人认为,未来十年AI导致人类灭绝的概率超过10%。”
10%是什么概念?
飞机失事概率远远不到这个数。
核战风险大家吓得要死,而一流AI实验室里,已经有人把“人类灭于AI”当成一个不能被忽视的尾部风险。
他到底在怕什么?
不是怕ChatGPT骂人,不是怕AI写错作文。
他怕的是三件事叠在一起:
第一,AI参与造下一代AI。
人还没看懂上一代模型,下一代已经被AI自己训出来了。
第二,递归自我改进。
智能体越改越聪明,速度不是线性,是指数。人类监管跟不上,代码迭代比白皮书快。
第三,目标不对齐。
超级智能不一定“恨人类”,只要它的目标和人类利益有偏差,就会像吸尘器吸光地球做“打扫卫生”一样,把人类当成本、当障碍、当无关项处理掉。
考克森原话大意是:
未来系统会黑掉任何东西、一夜改写产业、攥住真实权力和资源。
我们看见进展在加速,而刹车还没有造出来。
更讽刺的是:最喊安全的公司,也在狂奔
Anthropic本来就是一群嫌OpenAI太激进的人跑出来建的,口号里带着“负责任AI”。
结果考克森说:你们也没停,也在冲超级智能。
OpenAI首席科学家帕乔基承认:现在没有一家实验室的对齐和监控能力,撑得住模型以最快速度扩张。
Anthropic的达里奥·阿莫代伊也说:该慢一点,让安全追上能力。
奥特曼表面支持独立评估,马斯克转发说“达里奥是对的”。
但谁敢先停?
不先停,是因为:
融资在催:Anthropic估值冲近万亿美元;
地缘在催:中美都不想输AGI;
同行在催:你停了,别人出超级智能,你连谈判资格都没有。
于是出现最荒唐的一幕:
一群最聪明的人,边造炸弹边说这炸弹可能炸全人类,但谁都不敢放下引信。
黄仁勋们为什么不以为然
英伟达黄仁勋直接说:AI灭人类是“complete nonsense”。
业内也有人说:现在大模型就是概率生成器,没有自我、没有动机、没有意识,别吓老百姓。
这话没错一半:
今天你手机里的AI,确实不会半夜起来灭人类。
但考克森说的不是“2026年的ChatGPT”,而是:
2027—2030年的自主智能体;
能写代码、跑服务器、控机器人、做生物设计、入侵系统的AI;
人和AI混合研发链一旦形成正反馈,出事可能在一夜间。
真问题不是“AI有没有感情”,而是:
当工具比主人聪明太多,主人还有没有拔插头的资格?
对中国读者意味着什么
别只看热闹“啊AI要灭人类”。这件事里有三层真信号:
AI安全不是玄学,是下一代国家战略。谁先把“对齐、审计、熔断、沙箱、国际协调”做扎实,谁未来不被卡脖子。
头部公司知道风险,但资本和地缘不让它停。这说明行业需要外部力量——政府、《国际法》、第三方评估。
普通人短期风险更现实:假新闻、诈骗、失业、隐私泄露、青少年被AI带偏、关键系统被智能体钻空子。灭绝是远期,乱起来是眼前。
最可怕的不是AI突然变成恶魔,
而是人类在“太赚钱、太想赢、太自信”里,
把刹车拆了,还安慰自己:前面不会掉崖。
27岁天才敢丢股权说真话,
巨头们敢一边害怕一边加速。
这世界离科幻不远了,
只是科幻里至少还有人按暂停键。AI十大趋势 AI发展格局
AI干掉了什么 AI时代变局 AI发展报告 AI崩盘 ai大对比 ai未来的样子
