跳到正文
热点事件持续更新

FTC:序贯结构化压缩LLM注意力无需微调

1 篇报道1 个报道来源2 小时前 更新

先了解这件事

AI 综述

2026-10-02,arXiv发布一手研究,提出序贯结构化压缩框架FTC。该框架在固定存储预算下适配当前压缩模型,联合利用Q/K/V头结构,并对输出投影单独处理以应对表示变化。实验覆盖6B至32B七个解码器-only LLM,在五款现代GQA模型的WikiText-2困惑度上各keep ratio均最优,激进压缩下增益最大,改进可迁移到下游任务且在32B规模仍显著,无需微调或基于梯度的恢复。

AI 根据报道生成 · 2 小时前更新

报道时间线

沿着报道,了解事件的不同侧面。

10月2日
  1. arXiv · Statistics Machine Learning
    Sequential Functional Structured Tucker Compression for Large Language Model Attentions

    FTC是一种序贯结构化压缩框架,在固定存储预算下适配当前压缩模型并联合利用Q/K/V头结构,输出投影单独处理以应对表示变化。实验覆盖6B至32B七个解码器仅LLM,在五款现代GQA模型的WikiText-2困惑度上各keep ratio均最优,激进压缩下增益最大,且改进迁移到下游任务并在32B规模仍显著。无需微调或基于梯度的恢复。

本事件热度走势

还没有足够的连续观测数据,暂不绘制趋势。