技术突破

Fable 5夺冠全球AI自主科研大赛:18个大模型断网8天做实验,追平人类82%水平

2026年8月18日,Prime Intellect公开了迄今为止规模最大的前沿AI自主科研实验。18个全球最顶尖的大模型被断网关进"小黑屋"连续做了8天科研,完成153场完全自主的实验。任务赛道是nanoGPT优化器速通挑战(optimizer speedrun),由OpenAI研究员Keller Jordan在2024年5月创建。人类工程师两年间把训练124M参数GPT的时间从45分钟压到1.35分钟,而AI比的是规则极其严苛的纯优化器赛道——模型架构不准改、训练数据不许碰,只准动优化器、学习率调度和初始化。

Anthropic的Fable 5一骑绝尘,追平了人类82%的水平——数十位顶尖工程师耗时数月才创下的纪录,AI一举追平。此前5月Prime Intellect曾做过一次小规模实验,只用Opus 4.7和GPT-5.5两个模型跑了约1万次烧了14000个H200 GPU小时。这次直接拉了18个模型上场规模翻了十几倍。研究发布后直接引爆AI圈,连OpenAI的大佬都赶来强势围观,有人表示这是"迈向AI自主研究的重大里程碑","AI辅助"与"AI发现"之间的最后一道鸿沟正在被加速抹平。

OpenAI和Anthropic已先后把"AI自己造AI"的时间点押在2028年。这次实验是第一次有人真的用算力和时间去量化AI自主研究还差多远。Fable 5的表现说明:在受限但真实的科研场景中,最顶尖的AI已经能完成大部分人类工程师的优化工作,但剩下的18%差距可能也是最难的——涉及直觉跳跃、跨领域类比和创造性问题重构。对AI行业而言,当AI可以自主做研究,意味着模型迭代速度可能从"人类节奏"切换到"AI节奏"——如果AI能优化自己的训练过程,RSI递归自我改进的反馈环将开始闭合。

← 返回AI热点列表