热点事件持续更新
Self-Evolving Algorithm-Design Agents via PCPO
2 篇报道1 个报道来源2 小时前更新
先了解这件事
AI 综述
2026-10-01,arXiv发表两篇相关论文。其一提出PCPO框架,通过全局种群与混合策略更新实现样本高效的自演化算法设计,在电子设计自动化学习率调度任务上仅用4个芯片案例训练即在16个案例上超越OpenEvolve和ShinkaEvolve,8B基座模型性能接近GPT-5.5,并在四个GPU kernel设计任务上相对PyTorch Eager平均加速8.27倍。其二提出让同一冻结模型在同一版本harness上先作为求解器再作为提议者递归编辑自身的自改进框架,进化批次覆盖五个不同领域基准,训练与验证任务严格分离,并在五个分布外基准上评估。
AI 根据报道生成 · 1 小时前更新
最新进展10月1日 12:00
两篇论文同日发布,分别从参数化策略优化与递归harness自编辑两条路径推进自演化算法设计。事件进展
2 个进展
- 10月1日 12:00 · 1 篇报道Self-Evolving Algorithm-Design Agents via PCPOarXiv · Artificial Intelligence:Self-Evolving Algorithm-Design Agents:通过Population-Curated Policy Optimization逃离上下文进化停滞
- 10月1日 12:00 · 1 篇报道Self-Evolving Harness on Multiple Tasks with the Agent as ItarXiv · Artificial Intelligence:Self-Evolving Harness on Multiple Tasks with the Agent as Its Own Optimizer
报道时间线
沿着报道,了解事件的不同侧面。
10月1日
- arXiv · Artificial IntelligenceSelf-Evolving Algorithm-Design Agents:通过Population-Curated Policy Optimization逃离上下文进化停滞
论文提出样本高效的参数化自演化框架PCPO,利用全局种群和混合策略更新保留并复用高质量自生成算法。在电子设计自动化学习率调度任务上,仅用4个芯片案例训练即在16个案例上超越OpenEvolve和ShinkaEvolve等上下文进化方法;8B基座模型性能接近GPT-5.5,并降低推理token成本,在四个GPU kernel设计任务上相对PyTorch Eager平均加速8.27倍。
- arXiv · Artificial Intelligence精选Self-Evolving Harness on Multiple Tasks with the Agent as Its Own Optimizer
该研究提出让同一冻结模型在同一版本 harness 上先作为求解器执行任务、再作为提议者直接编辑自身 harness 的递归自改进框架。进化批次覆盖五个不同领域基准,训练与验证任务严格分离,并在五个分布外基准上评估。
本事件热度走势
还没有足够的连续观测数据,暂不绘制趋势。