arXiv · Machine Learning Theory· Luyao Tang, Cheng Chen·· 5 小时前AI 评分49
OmniMed-Jev:通过决策原生接口校准大视觉语言模型置信度以实现可信医疗多模态决策
OmniMed-Jev: Calibrating LVLM Confidence for Trustworthy Medical Multimodal Decisions via System One
AI 导读
OmniMed-Jev 将医疗决策表示为 Choice、None 或 Score 类型的概率分布,使报告置信度与真实准确率对齐。在与同骨干同数据同训练的生成式基线接口控制对比中,校准误差降低最多一个数量级,可靠性误差降低最多两倍,点预测性能相当;计数任务基线仍领先。代码已开源。
来源:arXiv · Machine Learning Theory · arxiv.org