跳到正文
原文
arXiv · Multiagent Systems· Kunal Jha, Max Kleiman-Weiner, Natasha Jaques·· 3 小时前AI 评分40

从独立学习到社交学习:LLM 递归社交改进的特征分析

From Solo to Social Learning: Characterizing Recursive Social Improvement in LLMs

AI 导读

研究发现当每个 LLM 智能体追求自身奖励时,通过观察同伴和复制技能能让学习更高效,但尚未更有效。三款 LLM 在社交学习中每 token 获得的奖励低于独立学习者,且探索范围过窄或 token 耗尽。技能被复制和传递后使种群集中于更少的独立发现。

来源:arXiv · Multiagent Systems · arxiv.org