arXiv · Artificial Intelligence· Jinhao Zhang, Zeyu Liu, Zicheng Yan, Yunquan Zhang, Daning Cheng, Song Tang·· 3 小时前AI 评分36
大语言模型微调是否必须依赖人类可读文本?DASA 方法通过激活梯度反馈优化连续嵌入实现等效或更优适配
Is Human-Readable Text Necessary for Effective LLM Fine-Tuning?
AI 导读
DASA 使用冻结参考模型的激活梯度反馈引导连续合成输入嵌入优化,直接用于下游微调而无需离散 token 投影。在 Llama 与 Qwen 家族 1B–32B 模型、6 个基准上,DASA 达到与自然文本数据相当或更优的性能,多数对比超越 GRADMM,并实现 3.6–4.9 倍加速、峰值 GPU 内存相当。
来源:arXiv · Artificial Intelligence · arxiv.org