跳到正文
原文
arXiv · Machine Learning Theory· Xinyu Li, Mononito Goswami, Hao Liu, Nikos Kanakaris, Langlin Huang, Prithwish Jana, Patrick Bl\"obaum, Purak Jain·· 2 小时前精选AI 评分62

Hermes:学习上下文推理解锁测试时计算扩展

Hermes: Learning Contextual Reasoning Unlocks Test-Time Scaling

AI 导读

arXiv 论文提出 Hermes 框架,通过可配置 harness 让模型自主决定上下文分配与复用,并结合 Hermes-Learn 两阶段训练缩小不同规模模型的能力差距。

推荐理由

论文提出让模型自主决策上下文分配与复用的框架,为测试时计算扩展提供了可迁移的新方法。

来源:arXiv · Machine Learning Theory · arxiv.org