Skip to content
arXiv · Computation and Language· Yue Zhao, Xiyang Hu, Zuobin Xiong, Zhangyu Wang, Ruolin Li·· 4 hr agoAI score44

AI4Fire:评测大语言模型在野火任务上的表现

AI4Fire: Evaluating Large Language Models on Wildfire Tasks

AI brief

AI4Fire 在五项野火任务上以 zero-shot 方式评测 6 个核心模型的 bare 与 grounded 表现,并额外扩展 29 个模型;文献检索发现 138 篇相关研究。

Source: arXiv · Computation and Language · arxiv.org