热点事件持续更新
SP-DocReader:面向文档OCR的差异感知自博弈框架
1 篇报道1 个报道来源2 小时前 更新
先了解这件事
AI 综述
2026年10月9日,arXiv Computer Vision(一手)报道了SP-DocReader框架。该框架面向文档OCR提出自博弈方案:先进行监督微调,再针对残余错误继续训练。其核心方法包括Reading Discrepancy Masking,用最长公共子序列对齐参考与生成token,并对未匹配位置打分;以及Focused Fidelity Loss,在未匹配真值位置施加负对数似然监督。训练仅针对OCR模块,骨干网络保持冻结。
AI 根据报道生成 · 2 小时前更新
最新进展10月9日 12:00
arXiv报道SP-DocReader框架,用差异掩码与保真损失做自博弈训练,仅训OCR模块。报道时间线
沿着报道,了解事件的不同侧面。
10月9日
- arXiv · Computer VisionSP-DocReader:面向精准文档 OCR 的差分感知自博弈框架
SP-DocReader 提出面向文档 OCR 的自博弈框架,在监督微调后针对残余错误训练,Reading Discrepancy Masking 用最长公共子序列对齐参考与生成 token 并对未匹配位置打分,Focused Fidelity Loss 在未匹配真值位置加负对数似然监督,仅训练 OCR 模块、骨干网络保持冻结。
本事件热度走势
还没有足够的连续观测数据,暂不绘制趋势。