Skip to content
arXiv · Machine Learning Theory· Xinyu Li, Mononito Goswami, Hao Liu, Nikos Kanakaris, Langlin Huang, Prithwish Jana, Patrick Bl\"obaum, Purak Jain·· 7 hr agoSelectedAI score62

Hermes:学习上下文推理解锁测试时计算扩展

Hermes: Learning Contextual Reasoning Unlocks Test-Time Scaling

AI brief

arXiv 论文提出 Hermes 框架,通过可配置 harness 让模型自主决定上下文分配与复用,并结合 Hermes-Learn 两阶段训练缩小不同规模模型的能力差距。

Why it matters

论文提出让模型自主决策上下文分配与复用的框架,为测试时计算扩展提供了可迁移的新方法。

Source: arXiv · Machine Learning Theory · arxiv.org