arXiv 研究:LLM 智能体群体偏袒随成本消失
热点事件持续更新
arXiv 研究:LLM 智能体群体偏袒随成本消失
1 篇报道1 个报道来源2 小时前更新
先了解这件事
AI 综述
arXiv 上线一项研究,在约4400个微型社会、330万次模型调用中测试15个 OpenAI 模型和3个 Claude 模型,发现群体标签带来的偏袒只在给他人打分且不损害自身利益时出现,一旦产生成本便消失。 在有代价的互动中,互动历史成为偏袒主因:15个模型里13个呈统计显著正效应,其中11个达10分制下约3.5至8分,并随轮次增长、延伸至陌生同标签者。脚本化历史显示,平等规范下偏袒趋近于零,个体声誉可覆盖群体偏好。
AI 根据报道生成 · 1 小时前更新
最新进展10月9日 12:00
研究:LLM 智能体为何偏爱自身群体——利害关系、观察到的规范与声誉报道时间线
沿着报道,了解事件的不同侧面。
10月9日
- arXiv:cs.AI研究:LLM 智能体为何偏爱自身群体——利害关系、观察到的规范与声誉
研究在约4400个微型社会、330万次模型调用中测试15个OpenAI模型和3个Claude模型,发现群体标签带来的偏袒只在给他人打分不损害自身利益时出现,一旦有成本便消失。有代价时,互动历史成为偏袒主因,在15个模型中13个呈统计显著正效应,其中11个达10分中的约3.5-8分,并随轮次增长、延伸至陌生同标签者。脚本化历史显示,平等规范下偏袒趋近于零,个体声誉可覆盖群体偏好。
本事件热度走势
还没有足够的连续观测数据,暂不绘制趋势。