arXiv · Computation and Language· Umaira Izhar, Gunjan Arora, Pushpendra Singh·· 4 hr agoAI score37
MH-INDIC:评测印度孕产妇健康场景中 LLM 文化对齐的框架
Measuring Cultural Alignment Beyond the Average: A Framework for Evaluating Maternal-Health LLM Interactions in Indian Contexts
AI brief
研究者提出 MH-INDIC 框架,通过十个孕产妇健康推理维度评测北印度城市与半城市语境下 LLM 的文化对齐。基于对 102 名孕产妇的 26 项调查评估十个 LLM,模型在人口层面对齐较好,但在不同人口与家庭画像上的行为变化显著低于人类群体。human-grounded prompting 在画像对齐与对话质量评分上表现更强。
Source: arXiv · Computation and Language · arxiv.org