热点事件持续更新
研究比较LLM抑郁严重度标准抽取与思维链
1 篇报道1 个报道来源2 小时前更新
先了解这件事
AI 综述
2026年10月1日,arXiv cs.CL 分类下发布一项研究,比较 LLM 对抑郁严重程度的评估方式。该研究在 Reddit 语料上,使用 3 个 LLM(规模从 9B 到前沿模型),并采用 PHQ-9 与 BDI-II 两份问卷,以二次加权 kappa 衡量一致性,对比 LLM 直接评分与临床标准提取两种路径。报道未给出具体一致性数值或各模型表现差异,也未说明研究结论倾向。目前该事件仅有这一篇报道,后续进展有待观察。
AI 根据报道生成 · 2 小时前更新
最新进展10月1日 12:00
arXiv 新研究对比 LLM 直接评分与临床标准提取评估抑郁严重度的一致性。报道时间线
沿着报道,了解事件的不同侧面。
10月1日
- arXiv:cs.CL(计算语言学,全量分类)结构化标准提取 vs. 思维链:评估 LLM 对抑郁严重程度的标准提取
研究对比了 LLM 直接评分与临床标准提取两种抑郁严重程度评估方式,在 Reddit 语料上用 3 个 LLM(9B 至前沿规模)和 PHQ-9、BDI-II 两份问卷以二次加权 kappa 衡量一致性。
本事件热度走势
还没有足够的连续观测数据,暂不绘制趋势。