Skip to content
arXiv · Databases· Yueying Li, Zhongle Xie, Ke Chen, Lidan Shou·· 4 hr agoAI score25

QCATS:面向高效预测查询处理的查询上下文感知 Transformer 切片

QCATS: Query Context-Aware Transformer Slicing for Efficient Predictive Query Processing

AI brief

QCATS 是一种查询上下文感知 Transformer 切片框架,在数据库系统内实现高效稀疏推理。它在查询粒度执行,用查询谓词和元数据统计在模型执行前预选上下文对齐的 FFN 切片,并采用异步 CPU-GPU 流水线与路由感知批处理优化。在 BERT-base 和 Qwen-0.6B 的四个预测查询负载上,延迟最高降低 4.42x,预测精度与稠密基线相当。

Source: arXiv · Databases · arxiv.org