跳到正文
原文
arXiv · Computation and Language· Marjan Celikik, Ana Peleteiro Ramallo, Javier Morales·· 3 小时前AI 评分51

语法概念标注规模化:部署的微调小语言模型超过提示前沿模型

Grammar Concept Annotation at Scale: Deployed Fine-Tuned Small Language Models Outperform Prompted Frontier Models

AI 导读

论文在语法掌握追踪任务上微调 Qwen3.5 小语言模型,并部署 0.8B 模型服务全部英语学习者。两个人工评测基准显示,部署的 0.8B 模型与 4B 对照模型在概念、证据片段和正确性嵌套匹配标准下 precision 与 recall 均超过提示的 GPT-5.4 和 GPT-5.6 Sol,服务成本约降低 16 倍。

来源:arXiv · Computation and Language · arxiv.org