Anthropic 公布递归自我改进内部数据:Mythos Preview 代码优化加速 52 倍
Anthropic 在 X 平台公布了一项内部基准测试:每次发布新模型时,要求模型优化一段训练小 AI 模型的代码使其运行更快。 熟练人类工程师需要 4-8 小时实现 4 倍加速;2025 年 5 月,Claude Opus 4 平均约 3 倍加速;2026 年 4 月发布的 Mythos Preview 平均达到约 52 倍。Anthropic 同时发布更正说明,澄清 Opus 4 的 3 倍加速基线来自 2025 年 5 月,而非 2024 年——该评估基准自 2024 年 9 月才建立,回测显示 2024 年 5 月的模型没有任何加速。 Anthropic 表示,虽然 Claude 目前尚不具备研究判断能力(即选择正确研究问题的能力),递归自我改进尚未到来,但如果当前趋势持续,AI 系统自行设计和构建继任者将变得合理。