跳到正文
原文
arXiv:cs.CL(计算语言学,全量分类)· Faiz Ghifari Haznitrama, Afrizal Hasbi Azizy, Faeyza Rishad Ardi·· 1 天前AI 评分55

arXiv 论文:大规模因子分析显示机器智能仅部分可解释

Large-scale factor analysis shows machine intelligence is only partially interpretable

AI 导读

研究者对 1,618 个语言模型在 456 个纯文本基准上的 13,251 个公开评测分数做因子分析,发现通用智力因子在最宽松估计下也只解释 70.8% 的性能方差,多数解远低于此。内容相近的基准未必聚类,$g$ 因子不被任何共同主题主导,也缺乏证据表明标准"智力"基准能很好代理它,这使得在语言模型开发中把通用智力当作可单独优化的目标缺乏支持。

来源:arXiv:cs.CL(计算语言学,全量分类) · arxiv.org