arXiv · Multiagent Systems· Shivani Kumar, Adarsh Bharathwaj, David Jurgens·· 3 小时前AI 评分42
合作行为画像预测多智能体 LLM 团队在 AI for Science 工作流中的表现
Cooperative Profiles Predict Multi-Agent LLM Team Performance in AI for Science Workflows
AI 导读
研究者用六个行为经济学博弈对 41 个开放权重 LLM 建模,发现由博弈导出的合作画像能稳健预测 AI for Science 任务中多智能体团队的表现。在共享预算约束下,善于协调并投资乘法式团队生产而非贪婪策略的模型,在准确性、质量和完整性三项科学报告指标上更优。该关联在控制多种因素后仍成立,表明合作倾向是 LLM 一种独立、可测量的属性,可作为高成本多智能体部署前的快速诊断。
来源:arXiv · Multiagent Systems · arxiv.org