跳到正文
原文
arXiv · Multiagent Systems· Shiwen Wang, Jian Yang, Xu Wang, Xincan Wang, Weiming Dong·· 7 小时前AI 评分27

Form and Void: 通过自主 AI 智能体实现纠缠式组合(FaV-A 多模态智能体)

Form and Void: Entangled Composition through an Autonomous AI Agent

AI 导读

FaV-A 是一个面向正负空间生成的多模态自主智能体,采用分阶段工作流:先生成基础物体,再分析形状与空间结构以识别负空间语义,最终输出组合指令供最终图像生成。实验与消融分析表明,FaV-A 比直接零-shot MLLM 基线更能生成视觉连贯且语义对齐的正负空间组合。

来源:arXiv · Multiagent Systems · arxiv.org