跳到正文
热点事件持续更新

研究比较LLM抑郁严重度标准抽取与思维链

1 篇报道1 个报道来源2 小时前更新

先了解这件事

AI 综述

2026年10月1日,arXiv cs.CL 分类下发布一项研究,比较 LLM 对抑郁严重程度的评估方式。该研究在 Reddit 语料上,使用 3 个 LLM(规模从 9B 到前沿模型),并采用 PHQ-9 与 BDI-II 两份问卷,以二次加权 kappa 衡量一致性,对比 LLM 直接评分与临床标准提取两种路径。报道未给出具体一致性数值或各模型表现差异,也未说明研究结论倾向。目前该事件仅有这一篇报道,后续进展有待观察。

AI 根据报道生成 · 2 小时前更新

报道时间线

沿着报道,了解事件的不同侧面。

10月1日
  1. arXiv:cs.CL(计算语言学,全量分类)
    结构化标准提取 vs. 思维链:评估 LLM 对抑郁严重程度的标准提取

    研究对比了 LLM 直接评分与临床标准提取两种抑郁严重程度评估方式,在 Reddit 语料上用 3 个 LLM(9B 至前沿规模)和 PHQ-9、BDI-II 两份问卷以二次加权 kappa 衡量一致性。

本事件热度走势

还没有足够的连续观测数据,暂不绘制趋势。