arXiv · Human-Computer Interaction· Seiya Ikeda, Shin-nosuke Ishikawa·· 7 hr agoSelectedAI score62
审计 AI Companion 的自我描述:证据在哪里
Where the Evidence Lives: Auditing AI Companions' Self-Descriptions
AI brief
论文提出将 agent 自我描述与用户判断及实现记录对照的审计方法,把每条声明标记为 supported、contradicted 或 unresolved,并应用于自主 companion Lita(部署一个月、9 名同事)。参与者认可风格性声明,拒绝关系性声明,记忆评分在中位及以上,但三层记忆中有两层从未执行累积步骤。
Why it matters
为自我描述可信度提供了可复现的审计框架,读者可据此审视 companion agent 的自述是否真有实现依据。
Source: arXiv · Human-Computer Interaction · arxiv.org