Skip to content
Hot eventLive

InterviewSim:基于面试的大规模人格模拟评估框架

1 reports1 sources3 hr ago updated

Get the story

AI overview

2026-10-02,arXiv《Computers and Society》报道 InterviewSim 框架,从 23,000 份公开人物访谈中提取 671,000+ 问答对(平均每人 11.5 小时内容),并设计内容相似性、事实一致性、人格对齐和事实知识保持四个互补指标。实验显示面试 grounding 在内容对齐与精确事实召回上优于传记资料和参数化提示;检索增强更保人格对齐,长时序上下文减少矛盾并提升事实召回。

Generated from reports · updated 2 hr ago

Timeline

Follow the coverage from different angles.

Oct 2, 2026
  1. arXiv · Computers and Society
    InterviewSim:面向面试人格模拟的可扩展评估框架

    InterviewSim 提出基于真实面试转录的人格模拟评估框架,从 23,000 份公开人物访谈中提取 671,000+ 问答对,平均每人 11.5 小时内容。框架包含内容相似性、事实一致性、人格对齐和事实知识保持四个互补指标。实验表明面试 grounding 在内容对齐与精确事实召回上优于传记资料和参数化提示,检索增强方法更保人格对齐,长时序上下文减少矛盾并提升事实召回。

Heat trend

There is not enough continuous observation data to draw a trend yet.