arXiv · Computer Vision· Wenping Yin, Fabian Desuer, Ziqi Liu, Naixia Mou, Weijia Li, Pedram Ghamisi, Xiao Xiang Zhu, Hao Li·· 3 小时前AI 评分34
GRDisaster:基于视觉语言模型与众包影像的多任务地理空间推理灾害制图框架
Decoding the Disaster: Multi-Task Geospatial Reasoning with Vision-Language Models and Crowdsourced Imagery for Disaster Mapping
AI 导读
GRDisaster 是一个基于视觉语言模型(VLM)的多任务地理空间推理灾害制图框架,利用众包影像补充传统遥感影像。框架基于 PhotoMappers 构建的 26,340 张图像基准数据集,通过确定性/概率性跨视图地理定位与多视图融合,将 VGI 影像与地理参考的街景及遥感影像关联,并引入空间推理指标进行跨视图验证与灾害损毁评估,提升 VLM 输出可解释性。
来源:arXiv · Computer Vision · arxiv.org