OpenAI 摊牌了:AI 已经是牛马的 3.1 倍!
昨晚 OpenAI 发了篇长文,头一回把 RSI(递归自我改进)的内部进展摊开讲。说白了,就是让 AI 研发下一代更强的 AI,新模型再接着推进,滚雪球。
官方确认:去年秋天立的"自动化研究实习生"目标,今年 9 月达成了——Agent 在人类给方向的前提下,能独立接手熟练研究员要跑好几天的工程任务。下一站:2028 年 3 月,全自动 AI 研究员。
内部研究员每天烧 600 美元推理费,重度用户一天 7000 美元;6 月前 Agent 总工时还不如人类,8 月中已翻转——每 1 个人类工作日对应 3.1 个 Agent 工作日。
人类要干 4-8 小时的任务,Agent 零干预成功率从 1 月 18% 拉到 7 月 55% 以上。
还有个细节特妙:内部答疑会没人去了,Agent 抢答比人快,有个团队干脆停办。
博文也写得克制:
OpenAI 坦言还不知道怎么安全走到"完整版 RSI",方向定义权和刹车权都攥在人手里,还呼吁其他实验室公开 RSI 监控进展。
我的看法:
飞轮确实转起来了,但"3.1 倍工时"不等于"3.1 倍突破"——难自动化的判断和品味,暂时还在人这边。
该盯的信号是:哪天 Agent 成规模地写"决定做什么",那才是第二章开场。ai ai工具 大模型


