arXiv:cs.CL(计算语言学,全量分类)· Neemias B. da Silva, Martin Lukk, Ali Sutani, Abhishek Moturu, Harris Yang, Daniel Silver, Matt Ratto, Thiago H. Silva·· 1 天前AI 评分46
Population Fidelity:评估 LLM 的人群代表性
Population Fidelity: Evaluating Population Representativeness in LLMs
AI 导读
研究者提出 Population Fidelity 评估框架,从群体级准确度、组间变异量及变异结构三个维度衡量 LLM 生成回答的人群代表性。复现"机器偏见"研究后发现,代表性差不仅源于组间变异不足,还在于变异被分配给了错误的群体;文化微调虽能提升与调查中心的整体一致性,却未改善群体内差异的刻画。框架附带可复用代码、数据与训练模型。
来源:arXiv:cs.CL(计算语言学,全量分类) · arxiv.org