arXiv · Computers and Society· Federico Mazzoni, Andrea Failla·· 4 hr agoAI score27
在线内容审核中基准测试 System One 模型
Benchmarking System One Models in Online Moderation
AI brief
研究评估了接受自然语言上下文、返回类型化选项、概率或分数的 System One 模型能否支撑在线内容审核。在五个审核基准上,Jev 与专用参考系统相当,在多项政策导向和有害内容场景中持平或超越;检索到的先例可提升其政策选择与有害内容判别。Laya 表现不稳定,检索常改变其预测率却未改善判别,其置信度对错误排序帮助有限。
Source: arXiv · Computers and Society · arxiv.org