arXiv · Multiagent Systems· Kunal Jha, Max Kleiman-Weiner, Natasha Jaques·· 3 小时前AI 评分40
从独立学习到社交学习:LLM 递归社交改进的特征分析
From Solo to Social Learning: Characterizing Recursive Social Improvement in LLMs
AI 导读
研究发现当每个 LLM 智能体追求自身奖励时,通过观察同伴和复制技能能让学习更高效,但尚未更有效。三款 LLM 在社交学习中每 token 获得的奖励低于独立学习者,且探索范围过窄或 token 耗尽。技能被复制和传递后使种群集中于更少的独立发现。
来源:arXiv · Multiagent Systems · arxiv.org