跳到正文
热点事件持续更新

研究:105个语言模型单词选择题答案趋同

1 篇报道1 个报道来源3 小时前更新

先了解这件事

AI 综述

Tapan Parikh 发布的一项 arXiv 论文测试了 105 个语言模型在 96 个“说出一个词”单轮提示上的答案选择:被要求“挑一个词”时,46% 的模型选择了“serendipity”。所有提示词、对话记录和代码均已公开。 研究还发现,96 个类别中有 28 个类别单一答案占比超过 80%,87 个主流实验室模型的集中度不低于整体水平。轻度后训练和人格微调模型的答案分歧最大,重度后训练的助手模型最趋同,监督微调是模型走向趋同的最大一步。

AI 根据报道生成 · 2 小时前更新

报道时间线

沿着报道,了解事件的不同侧面。

10月9日
  1. arXiv:cs.CL
    一项针对 44 个语言模型的“单词普查”:答案选择趋同性研究

    一项研究用 96 个单轮提示词测试了 105 个语言模型在“说出一个词”类任务中的答案趋同现象,发现“serendipity”一词被 46% 的模型选中。在 96 个类别中有 28 个类别单一答案占比超过 80%,且 87 个主流实验室模型的集中度不低于整体水平。轻量后训练和人格微调模型分歧最大,重度后训练的助手模型最趋同;监督微调是走向趋同的最大一步。

本事件热度走势

还没有足够的连续观测数据,暂不绘制趋势。