跳到正文
热点事件持续更新

Self-Evolving Algorithm-Design Agents via PCPO

2 篇报道1 个报道来源2 小时前更新

先了解这件事

AI 综述

2026-10-01,arXiv发表两篇相关论文。其一提出PCPO框架,通过全局种群与混合策略更新实现样本高效的自演化算法设计,在电子设计自动化学习率调度任务上仅用4个芯片案例训练即在16个案例上超越OpenEvolve和ShinkaEvolve,8B基座模型性能接近GPT-5.5,并在四个GPU kernel设计任务上相对PyTorch Eager平均加速8.27倍。其二提出让同一冻结模型在同一版本harness上先作为求解器再作为提议者递归编辑自身的自改进框架,进化批次覆盖五个不同领域基准,训练与验证任务严格分离,并在五个分布外基准上评估。

AI 根据报道生成 · 1 小时前更新

事件进展

2 个进展
  1. 10月1日 12:00 · 1 篇报道
    Self-Evolving Algorithm-Design Agents via PCPO
    arXiv · Artificial Intelligence:Self-Evolving Algorithm-Design Agents:通过Population-Curated Policy Optimization逃离上下文进化停滞
  2. 10月1日 12:00 · 1 篇报道
    Self-Evolving Harness on Multiple Tasks with the Agent as It
    arXiv · Artificial Intelligence:Self-Evolving Harness on Multiple Tasks with the Agent as Its Own Optimizer

报道时间线

沿着报道,了解事件的不同侧面。

10月1日
  1. arXiv · Artificial Intelligence
    Self-Evolving Algorithm-Design Agents:通过Population-Curated Policy Optimization逃离上下文进化停滞

    论文提出样本高效的参数化自演化框架PCPO,利用全局种群和混合策略更新保留并复用高质量自生成算法。在电子设计自动化学习率调度任务上,仅用4个芯片案例训练即在16个案例上超越OpenEvolve和ShinkaEvolve等上下文进化方法;8B基座模型性能接近GPT-5.5,并降低推理token成本,在四个GPU kernel设计任务上相对PyTorch Eager平均加速8.27倍。

  2. arXiv · Artificial Intelligence精选
    Self-Evolving Harness on Multiple Tasks with the Agent as Its Own Optimizer

    该研究提出让同一冻结模型在同一版本 harness 上先作为求解器执行任务、再作为提议者直接编辑自身 harness 的递归自改进框架。进化批次覆盖五个不同领域基准,训练与验证任务严格分离,并在五个分布外基准上评估。

本事件热度走势

还没有足够的连续观测数据,暂不绘制趋势。