Lilian Weng·· 2022-06-10AI 评分30
通用视觉语言模型综述
Generalized Visual Language Models
AI 导读
summary_zh: VisualBERT 将图像区域与文本共同输入 BERT,在 MS COCO 上训练,NLVR 和 Flickr30K 上超越当时 SOTA,VQA 上仍有差距。
来源:Lilian Weng · lilianweng.github.io
Generalized Visual Language Models
summary_zh: VisualBERT 将图像区域与文本共同输入 BERT,在 MS COCO 上训练,NLVR 和 Flickr30K 上超越当时 SOTA,VQA 上仍有差距。
来源:Lilian Weng · lilianweng.github.io