跳到正文
热点事件持续更新

SP-DocReader:面向文档OCR的差异感知自博弈框架

1 篇报道1 个报道来源2 小时前 更新

先了解这件事

AI 综述

2026年10月9日,arXiv Computer Vision(一手)报道了SP-DocReader框架。该框架面向文档OCR提出自博弈方案:先进行监督微调,再针对残余错误继续训练。其核心方法包括Reading Discrepancy Masking,用最长公共子序列对齐参考与生成token,并对未匹配位置打分;以及Focused Fidelity Loss,在未匹配真值位置施加负对数似然监督。训练仅针对OCR模块,骨干网络保持冻结。

AI 根据报道生成 · 2 小时前更新

报道时间线

沿着报道,了解事件的不同侧面。

10月9日
  1. arXiv · Computer Vision
    SP-DocReader:面向精准文档 OCR 的差分感知自博弈框架

    SP-DocReader 提出面向文档 OCR 的自博弈框架,在监督微调后针对残余错误训练,Reading Discrepancy Masking 用最长公共子序列对齐参考与生成 token 并对未匹配位置打分,Focused Fidelity Loss 在未匹配真值位置加负对数似然监督,仅训练 OCR 模块、骨干网络保持冻结。

本事件热度走势

还没有足够的连续观测数据,暂不绘制趋势。