大模型前沿速递

递归自我改进从概念叙事转向工程化验证与风险控制

递归自我改进从概念叙事转向工程化验证与风险控制

AI脚手架、研究智能体、自动实验和训练基础设施正推动递归自我改进进入可测量阶段,AI for Science也强调数据、算力、科研组织和制造验证的闭环竞争。Sakana AI论文审阅系统虽报告核心论断错误检测率73.43%、成本约0.47美元,但真实论文表现下降并受提示注入影响,尚未证明稳定的无人值守自主研究突破。

Sources (2)
Updated Oct 11, 2026