arXiv · Computation and Language· Yue Zhao, Xiyang Hu, Zuobin Xiong, Zhangyu Wang, Ruolin Li·· 3 小时前AI 评分44
AI4Fire:评测大语言模型在野火任务上的表现
AI4Fire: Evaluating Large Language Models on Wildfire Tasks
AI 导读
AI4Fire 在五项野火任务上以 zero-shot 方式评测 6 个核心模型的 bare 与 grounded 表现,并额外扩展 29 个模型;文献检索发现 138 篇相关研究。
来源:arXiv · Computation and Language · arxiv.org