跳到正文
原文
arXiv · Artificial Intelligence· Tianxiang Gao, Jinzhe Li, Zhiyuan Li, Yi Chang, Yuan Wu·· 3 小时前AI 评分38

JEV 与 KEV 直接决策模型的序数尺度偏差分析

More Choices, Fewer Decisions: Ordinal-Scale Bias in JEV-like Direct-Decision Models

AI 导读

JEV~1.13 和三个开源 KEV 模型在序数分类任务中表现出决策尺度利用率不足,ANLI 上 38.8% 预测与 51.3% 错误被归入 Neutral。36 个序数数据集上最终决策仅使用 67–76% 的有效金标准支持度,而名义任务达 87–102%;K=14 时利用率降至 26–75%。BA-LoRA 微调可将金标准相对利用率从约 47% 提升至 86%,代码与数据已公开。

来源:arXiv · Artificial Intelligence · arxiv.org