Anthropic自曝"私藏核武器":内部模型Model 2比Mythos 5更强,研发未暂停
2026年8月15日,Anthropic发布第二份《Risk Report》,首次亲口承认公司内部跑着一个比Mythos 5更强的模型,代号Model 2。在AECC综合能力得分上:Mythos Preview 158.91,Mythos 5涨到161.29,Model 2再顶到162.79。Anthropic表示"目前没有对外发布这个模型的计划",但Model 2和Mythos 5已被公司"大量"用于编码、Agent工作和数据生成。
报告披露了令人震惊的事实:Claude已写下Anthropic合并进生产代码库的绝大多数代码,内部AI研发速度因AI辅助显著加快但尚未到两倍——而"两倍"正是RSP触发AI研发风险红线的条件。在CoBench测试上Model 2拿了62.8%比Mythos Preview高8个百分点,Anthropic人类研究员成功率为85%——模型尚未取代研究科学家但差距在肉眼可见地缩小。更令人不安的是,Anthropic承认"最具体的基于任务的评测已经饱和——无法再捕捉模型能力的提升,正在看到加速的早期迹象"。
同期OpenAI推迟新模型Astra,理由是内部测试无法排除"关键级别"的网络攻击能力——Astra可能具备独立发现零日漏洞、对高防护目标发起完整攻击链的能力。两家都攥着不打算给用户用的模型,区别是OpenAI把Astra部分研发按停了,而Model 2在Anthropic内部照跑不误。AI分析师ChrisGPT指出:"如果所有人都在给自己的前沿模型踩刹车,唯独现在处在领先位置的主要公司之一没踩,那绝对值得注意。"半个月前Dario Amodei刚在"Pacing the Frontier"公开信上签字,1300多名员工联名呼吁放慢前沿AI开发——字签了,话说了,刹车机制还没建好,油门自己踩到底了。