跳到正文
原文
arXiv · Human-Computer Interaction· Seiya Ikeda, Shin-nosuke Ishikawa·· 2 小时前精选AI 评分62

审计 AI Companion 的自我描述:证据在哪里

Where the Evidence Lives: Auditing AI Companions' Self-Descriptions

AI 导读

论文提出将 agent 自我描述与用户判断及实现记录对照的审计方法,把每条声明标记为 supported、contradicted 或 unresolved,并应用于自主 companion Lita(部署一个月、9 名同事)。参与者认可风格性声明,拒绝关系性声明,记忆评分在中位及以上,但三层记忆中有两层从未执行累积步骤。

推荐理由

为自我描述可信度提供了可复现的审计框架,读者可据此审视 companion agent 的自述是否真有实现依据。

来源:arXiv · Human-Computer Interaction · arxiv.org