跳到正文
热点事件持续更新

ActiveSaddler:面向 Agent Harness 优化的自动化课程学习

1 篇报道1 个报道来源2 小时前 更新

先了解这件事

AI 综述

ActiveSaddler 将 harness 优化中的训练场景选择建模为非平稳多臂老虎机,通过抽象失败模式并动态调整优化目标,使课程与 harness 协同进化。在 GAIA2 和 Terminal-Bench 2.0 上,相比固定场景顺序的优化器,Pass@1 分别提升 4.4 和 7.5 个百分点。消融实验表明,收益依赖于动态构建优化目标、估计其效用以及平衡已知弱点与未知场景的探索。

AI 根据报道生成 · 1 小时前更新

报道时间线

沿着报道,了解事件的不同侧面。

10月2日
  1. arXiv · Artificial Intelligence
    ActiveSaddler:面向 Agent Harness 优化的自动化课程学习

    ActiveSaddler 将 harness 优化中的训练场景选择建模为非平稳多臂老虎机,通过抽象失败模式并动态调整优化目标,使课程与 harness 协同进化。在 GAIA2 和 Terminal-Bench 2.0 上,相比固定场景顺序的优化器,Pass@1 分别提升 4.4 和 7.5 个百分点。消融实验表明,收益依赖于动态构建优化目标、估计其效用以及平衡已知弱点与未知场景的探索。

本事件热度走势

还没有足够的连续观测数据,暂不绘制趋势。