arXiv · Multiagent Systems· Shiwen Wang, Jian Yang, Xu Wang, Xincan Wang, Weiming Dong·· 7 小时前AI 评分27
Form and Void: 通过自主 AI 智能体实现纠缠式组合(FaV-A 多模态智能体)
Form and Void: Entangled Composition through an Autonomous AI Agent
AI 导读
FaV-A 是一个面向正负空间生成的多模态自主智能体,采用分阶段工作流:先生成基础物体,再分析形状与空间结构以识别负空间语义,最终输出组合指令供最终图像生成。实验与消融分析表明,FaV-A 比直接零-shot MLLM 基线更能生成视觉连贯且语义对齐的正负空间组合。
来源:arXiv · Multiagent Systems · arxiv.org