跳到正文
原文
arXiv · Computation and Language· Tobias Hallmen, Elisabeth Andr\'e·· 3 小时前AI 评分35

语言承载专家印象:锚定量表的 LLM 评委跨域迁移咨询质量评估,胜过域内训练

Language Carries the Expert's Impression: Instrument-Anchored LLM Judges Transfer Counseling-Quality Assessment and Beat In-Domain Training

AI 导读

一项针对三个德语模拟咨询语料(n=195 专家评分会话)的研究显示,跨域迁移训练预测专家总体印象优于目标域内训练,留一域迁移的嵌套 Spearman ρ 达 0.54,域内仅 ≤0.48,规模匹配后差距仍为 +0.12。

来源:arXiv · Computation and Language · arxiv.org