Skip to content
arXiv · Computation and Language· Jing Chen, Giulia Loca, Simona Amenta, Marco Marelli·· 4 hr agoAI score25

伪词探测:LLM 几乎不具备支配人类伪词处理的亚词敏感性

Pseudowords as probes: Large Language Models show little of the sublexical sensitivity that governs human pseudoword processing

AI brief

一项针对五个 LLM 的意大利语双选伪词实验显示,当真实词选项提供词汇熟悉度线索时,LLM 与人类判断更一致;在纯伪词条件下则大幅低于字符 n-gram 模型 fastText。驱动人类—fastText 一致性的亚词余弦相似度线索并未稳定迁移到人类—LLM 对齐,推理 token 消耗与人类加工难度也无稳定关联;作者将分词与训练数据覆盖列为候选解释。

Source: arXiv · Computation and Language · arxiv.org