arXiv · Databases· Yueying Li, Zhongle Xie, Ke Chen, Lidan Shou·· 3 小时前AI 评分25
QCATS:面向高效预测查询处理的查询上下文感知 Transformer 切片
QCATS: Query Context-Aware Transformer Slicing for Efficient Predictive Query Processing
AI 导读
QCATS 是一种查询上下文感知 Transformer 切片框架,在数据库系统内实现高效稀疏推理。它在查询粒度执行,用查询谓词和元数据统计在模型执行前预选上下文对齐的 FFN 切片,并采用异步 CPU-GPU 流水线与路由感知批处理优化。在 BERT-base 和 Qwen-0.6B 的四个预测查询负载上,延迟最高降低 4.42x,预测精度与稠密基线相当。
来源:arXiv · Databases · arxiv.org