跳到正文
热点事件持续更新

无需模型:文本熵率过滤缓解迭代微调崩溃

1 篇报道1 个报道来源2 小时前 更新

先了解这件事

AI 综述

arXiv 论文提出基于 Kontoyiannis 熵率估计器 h_k 的非参数文本过滤方法,完全从原始文本的匹配长度统计计算,无需任何模型。在六代 QLoRA 微调 Llama-3.1-8B 的崩溃实验中,h_k 过滤相较对数概率过滤实现 +42% 唯一三元组、+30% 词汇量和 -19% 重复(p < 0.001),并在 4 域、1520 份生成文档上验证为跨域熵代理与崩溃检测器。

AI 根据报道生成 · 2 小时前更新

报道时间线

沿着报道,了解事件的不同侧面。

10月2日
  1. arXiv · Statistics Machine Learning
    无需模型:文本熵率过滤缓解迭代微调崩溃

    arXiv 论文提出基于 Kontoyiannis 熵率估计器 h_k 的非参数文本过滤方法,完全从原始文本的匹配长度统计计算,无需任何模型。在六代 QLoRA 微调 Llama-3.1-8B 的崩溃实验中,h_k 过滤相较对数概率过滤实现 +42% 唯一三元组、+30% 词汇量和 -19% 重复(p < 0.001),并在 4 域、1520 份生成文档上验证为跨域熵代理与崩溃检测器。

本事件热度走势

还没有足够的连续观测数据,暂不绘制趋势。