跳到正文
原文
arXiv:cs.CL(计算语言学,全量分类)· Neemias B. da Silva, Martin Lukk, Ali Sutani, Abhishek Moturu, Harris Yang, Daniel Silver, Matt Ratto, Thiago H. Silva·· 1 天前AI 评分46

Population Fidelity:评估 LLM 的人群代表性

Population Fidelity: Evaluating Population Representativeness in LLMs

AI 导读

研究者提出 Population Fidelity 评估框架,从群体级准确度、组间变异量及变异结构三个维度衡量 LLM 生成回答的人群代表性。复现"机器偏见"研究后发现,代表性差不仅源于组间变异不足,还在于变异被分配给了错误的群体;文化微调虽能提升与调查中心的整体一致性,却未改善群体内差异的刻画。框架附带可复用代码、数据与训练模型。

来源:arXiv:cs.CL(计算语言学,全量分类) · arxiv.org