跳到正文
原文
arXiv · Computation and Language· Yue Zhao, Xiyang Hu, Zuobin Xiong, Zhangyu Wang, Ruolin Li·· 3 小时前AI 评分44

AI4Fire:评测大语言模型在野火任务上的表现

AI4Fire: Evaluating Large Language Models on Wildfire Tasks

AI 导读

AI4Fire 在五项野火任务上以 zero-shot 方式评测 6 个核心模型的 bare 与 grounded 表现,并额外扩展 29 个模型;文献检索发现 138 篇相关研究。

来源:arXiv · Computation and Language · arxiv.org