热点事件持续更新
递归自我改进中安全性延续问题研究
1 篇报道1 个报道来源2 小时前 更新
先了解这件事
AI 综述
2026-10-02,arXiv 软件工程领域发表论文《Safety Must Survive Self-Improvement: Why Failures Persist and How Agents Recover》,研究递归自我改进(RSI)中的安全性延续问题。研究通过有状态授权任务的受控测试台,分析固定 LLM 编辑器对可执行智能体组件的优化与独立轨迹记录。在 48 条框架历史中,新授权依赖使历史分数在 22 条中保留不安全程序,尽管每个受影响归档都有正确替代方案;刷新分数可恢复原始套件正确性,但独立组合测试仍有残留失效。
AI 根据报道生成 · 1 小时前更新
最新进展10月2日 12:00
论文指出刷新分数可恢复原始套件正确性,但独立组合测试仍有残留失效。报道时间线
沿着报道,了解事件的不同侧面。
10月2日
- arXiv · Software Engineering精选Safety Must Survive Self-Improvement: Why Failures Persist and How Agents Recover
论文研究递归自我改进(RSI)中的安全性延续问题,通过有状态授权任务的受控测试台,分析固定 LLM 编辑器对可执行智能体组件的优化与独立轨迹记录。在 48 条框架历史中,新授权依赖使历史分数在 22 条中保留不安全程序,尽管每个受影响归档都有正确替代方案;刷新分数可恢复原始套件正确性,但独立组合测试仍有残留失效。
本事件热度走势
还没有足够的连续观测数据,暂不绘制趋势。