跳到正文
热点事件持续更新

Kimi K2.7 Code经RL训练后在多个编码基准上显著提升

1 篇报道1 个报道来源2 小时前 更新

先了解这件事

AI 综述

2026-10-02 arXiv发布软件工程领域研究:研究者对Kimi K2.7 Code(1T参数,32B激活)进行单epoch GSPO RL后训练,仅用1700个任务,即在SWE-Bench Pro、DeepSWE、Terminal-Bench 2.1/3/4和SWE-Marathon六个外部基准上提升pass@1,且对训练后发布的三个数据集仍显著(p=0.004)。

AI 根据报道生成 · 1 小时前更新

报道时间线

沿着报道,了解事件的不同侧面。

10月2日
  1. arXiv · Software Engineering精选
    基于智能体编码任务的 RL 跨基准迁移研究

    研究者对 Kimi K2.7 Code(1T 参数,32B 激活)进行单 epoch GSPO RL 后训练,仅用 1700 个任务,即在 SWE-Bench Pro、DeepSWE、Terminal-Bench 2.1/3/4 和 SWE-Marathon 六个外部基准上提升 pass@1,且对训练后发布的三个数据集仍显著(p=0.004)。

本事件热度走势

还没有足够的连续观测数据,暂不绘制趋势。