CMU Robotics Institute· Mallory Lindahl·· 2026-07-20精选AI 评分60
医疗盲点:AI模型易编造诊断
Healthcare Blind Spots: AI Models Prone To Fabricating Diagnoses
AI 导读
CMU研究显示,Claude、GPT-5和Gemini在18%的情况下会编造医疗诊断,尤其依赖患者的年龄、性别和种族进行假设。研究者Siddharth Vohra分析了约11,700条模型回应,发现约82%的回应因缺少影像而拒绝,但剩余18%会凭空给出诊断。
推荐理由
研究揭示了主流模型在缺失影像时依赖人口统计假设编造诊断,对医疗AI的可靠性与测试流程有直接警示。
来源:CMU Robotics Institute · ri.cmu.edu