arXiv · Machine Learning Theory· Xinyu Li, Mononito Goswami, Hao Liu, Nikos Kanakaris, Langlin Huang, Prithwish Jana, Patrick Bl\"obaum, Purak Jain·· 8 hr agoSelectedAI score62
Hermes:学习上下文推理解锁测试时计算扩展
Hermes: Learning Contextual Reasoning Unlocks Test-Time Scaling
AI brief
arXiv 论文提出 Hermes 框架,通过可配置 harness 让模型自主决定上下文分配与复用,并结合 Hermes-Learn 两阶段训练缩小不同规模模型的能力差距。
Why it matters
论文提出让模型自主决策上下文分配与复用的框架,为测试时计算扩展提供了可迁移的新方法。
Source: arXiv · Machine Learning Theory · arxiv.org