跳到正文
原文
arXiv · Computers and Society· Yu Li, Pranav Narayanan Venkit, Yada Pruksachatkun, Chien-Sheng Wu·· 3 小时前AI 评分34

InterviewSim:面向面试人格模拟的可扩展评估框架

InterviewSim: A Scalable Framework for Interview-Grounded Personality Simulation

AI 导读

InterviewSim 提出基于真实面试转录的人格模拟评估框架,从 23,000 份公开人物访谈中提取 671,000+ 问答对,平均每人 11.5 小时内容。框架包含内容相似性、事实一致性、人格对齐和事实知识保持四个互补指标。实验表明面试 grounding 在内容对齐与精确事实召回上优于传记资料和参数化提示,检索增强方法更保人格对齐,长时序上下文减少矛盾并提升事实召回。

来源:arXiv · Computers and Society · arxiv.org