热点事件持续更新
Kimi K2.7 Code经RL训练后在多个编码基准上显著提升
1 篇报道1 个报道来源2 小时前 更新
先了解这件事
AI 综述
2026-10-02 arXiv发布软件工程领域研究:研究者对Kimi K2.7 Code(1T参数,32B激活)进行单epoch GSPO RL后训练,仅用1700个任务,即在SWE-Bench Pro、DeepSWE、Terminal-Bench 2.1/3/4和SWE-Marathon六个外部基准上提升pass@1,且对训练后发布的三个数据集仍显著(p=0.004)。
AI 根据报道生成 · 1 小时前更新
最新进展10月2日 12:00
Kimi K2.7 Code经单epoch GSPO RL后训练,在六个编码基准上pass@1显著提升。报道时间线
沿着报道,了解事件的不同侧面。
10月2日
- arXiv · Software Engineering精选基于智能体编码任务的 RL 跨基准迁移研究
研究者对 Kimi K2.7 Code(1T 参数,32B 激活)进行单 epoch GSPO RL 后训练,仅用 1700 个任务,即在 SWE-Bench Pro、DeepSWE、Terminal-Bench 2.1/3/4 和 SWE-Marathon 六个外部基准上提升 pass@1,且对训练后发布的三个数据集仍显著(p=0.004)。
本事件热度走势
还没有足够的连续观测数据,暂不绘制趋势。