跳到正文
热点事件持续更新

LLM 否定处理机制与基准研究

1 篇报道1 个报道来源2 小时前 更新

先了解这件事

AI 综述

2026-10-08,arXiv Computation and Language 发布一手研究,在自建否定评测基准上测试近期开源与闭源 LLM,考察模型如何改变否定条件下的预测。结果显示,在 37%–71% 的情况下,模型在否定问句下仍重复原答案(例如“What is not the capital of Spain?”)。该研究为目前唯一报道,事件尚无更早或后续报道,亦无相互矛盾的数字或说法。

AI 根据报道生成 · 2 小时前更新

报道时间线

沿着报道,了解事件的不同侧面。

10月8日
  1. arXiv · Computation and Language
    LLM 如何改变否定条件下的预测?

    研究在自建的否定评测基准上测试近期开源与闭源 LLM,发现 37-71% 的情况下模型在否定问句下仍重复原答案(如"What is not the capital of Spain?

本事件热度走势

还没有足够的连续观测数据,暂不绘制趋势。