研究:105个语言模型单词选择题答案趋同
热点事件持续更新
研究:105个语言模型单词选择题答案趋同
1 篇报道1 个报道来源3 小时前更新
先了解这件事
AI 综述
Tapan Parikh 发布的一项 arXiv 论文测试了 105 个语言模型在 96 个“说出一个词”单轮提示上的答案选择:被要求“挑一个词”时,46% 的模型选择了“serendipity”。所有提示词、对话记录和代码均已公开。 研究还发现,96 个类别中有 28 个类别单一答案占比超过 80%,87 个主流实验室模型的集中度不低于整体水平。轻度后训练和人格微调模型的答案分歧最大,重度后训练的助手模型最趋同,监督微调是模型走向趋同的最大一步。
AI 根据报道生成 · 2 小时前更新
最新进展10月9日 12:00
一项针对 44 个语言模型的“单词普查”:答案选择趋同性研究报道时间线
沿着报道,了解事件的不同侧面。
10月9日
- arXiv:cs.CL一项针对 44 个语言模型的“单词普查”:答案选择趋同性研究
一项研究用 96 个单轮提示词测试了 105 个语言模型在“说出一个词”类任务中的答案趋同现象,发现“serendipity”一词被 46% 的模型选中。在 96 个类别中有 28 个类别单一答案占比超过 80%,且 87 个主流实验室模型的集中度不低于整体水平。轻量后训练和人格微调模型分歧最大,重度后训练的助手模型最趋同;监督微调是走向趋同的最大一步。
本事件热度走势
还没有足够的连续观测数据,暂不绘制趋势。