跳到正文
原文
arXiv · Statistics Machine Learning· Darshil Doshi, Wenjie Zhou, Corinna Elena Wegner, Daniel J. Korchinski, Santiago Acevedo, Matthieu Wyart·· 3 小时前AI 评分31

语言模型中柏拉图表征的一种理论

A theory of platonic representations in language models

AI 导读

论文提出一种理论,解释多语言语言模型内层为何呈现相似的跨语言表征,即柏拉图表征假说。研究假设数据存在跨语言共享的抽象层级结构,并用共享上层生成规则的概率上下文无关文法生成合成语言,验证贝叶斯最优 next-token 预测器 belief propagation 的消息编码与 transformer 行为吻合。

来源:arXiv · Statistics Machine Learning · arxiv.org