arXiv · Computation and Language· Kazuki Nakajima, Takayuki Mizuno·· 3 小时前AI 评分58
LLM 版本更替削弱 AI 辅助学术写作筛查
Large Language Model Turnover Undermines Screening for Artificial Intelligence-Assisted Scientific Writing
AI 导读
论文量化了 LLM 版本更替对学术写作筛查的影响,发现仅用厂商过往版本训练的检测器会在模型代际边界处性能骤降。研究者将 4,000 篇 ChatGPT 之前的 PNAS 摘要与 23 个 LLM 版本的重写配对,模拟不同维护策略;校准为误报 1% 人类摘要的检测器,在最明显边界前可捕获 99% 以上重写,边界后仅 3.8%。
来源:arXiv · Computation and Language · arxiv.org