跳到正文
原文
arXiv · Multiagent Systems· Fabio Orazio Mirto, Luca D'Agati, Giuseppe Tricomi, Stefano Silvestri, Francesco Longo, Antonio Puliafito, Giovanni Merlino·· 3 小时前AI 评分36

智能体 AI 系统验证:超越组件测试

Beyond Component Testing: Validating Agentic AI Systems

AI 导读

一项系统性映射研究综合 262 篇论文,提出覆盖行为、安全、时间、监管与多智能体五个维度的分类法,用于刻画智能体 AI 系统的验证问题。现有文献集中于行为评估(105/262 篇),时间有效性最薄弱(14 篇);监管研究主要依赖保证案例与监管分析,多智能体研究则以基准为主。

来源:arXiv · Multiagent Systems · arxiv.org