跳到正文
热点事件持续更新

StateTree通过强化学习增强长期对话推理

1 篇报道1 个报道来源2 小时前更新

先了解这件事

AI 综述

2026-10-01,arXiv发表一手研究,提出StateTree:一种基于数据驱动强化学习的方法,通过构建树结构路径追踪任务增强长期对话推理能力。该方法在10K-token上下文上训练,可泛化至128K tokens。实验显示,StateTree-7B在LongMemEval(128k)上提升达+23.60%,StateTree-14B取得59.00%准确率,超越QwenLong-L1-32B的45.20%。

AI 根据报道生成 · 1 小时前更新

报道时间线

沿着报道,了解事件的不同侧面。

10月1日
  1. arXiv · Computation and Language
    StateTree:通过强化学习增强长期对话推理能力

    StateTree 是一种基于数据驱动的强化学习方法,通过构建树结构路径追踪任务来增强长期对话推理能力。该方法在 10K-token 上下文上训练,可泛化至 128K tokens,StateTree-7B 在 LongMemEval (128k) 上提升达 +23.60%,StateTree-14B 取得 59.00% 准确率,超越 QwenLong-L1-32B 的 45.20%。

本事件热度走势

还没有足够的连续观测数据,暂不绘制趋势。