arXiv · Computation and Language· Sihyeon Lee, Jihun Song, Chanwoo Kim, Jiwoo Kum, Chanjun Park·· 3 小时前AI 评分37
OMIT:测量哲学分歧下框架不变的遗漏偏差
OMIT the Action: Measuring Framing-Invariant Omission Bias under Philosophical Disagreement
AI 导读
研究者推出 OMIT 评测基准,包含 218 组配对框架场景、覆盖 10 类冲突,由 LLM 驱动的五视角哲学人格面板(功利主义、义务论、美德伦理、关怀伦理、契约论)构建。对 8 个 LLM 的评估显示遗漏偏差普遍存在,但在同一模型族内与模型规模呈负相关;4 种推理时干预中,先让模型考虑道德原则再作答可降低遗漏偏差并提升框架一致性。
来源:arXiv · Computation and Language · arxiv.org