跳到正文
原文
arXiv:cs.CL(计算语言学,全量分类)· Eftekhar Hossain, John Salvador, Santu Karmaker·· 3 小时前AI 评分33

研究:LLM 能否可靠地连接叙事中的 DOTs?

Evaluating Whether LLMs Can Reliably Connect the DOTs?

AI 导读

一项 arXiv 研究构建了约 9.2K 实例的多领域叙事补全基准,覆盖百科文本、常识故事、新闻和视觉叙事四类,评测了 20 个 1.5B 至 70B 参数的开源指令微调 LLM。

来源:arXiv:cs.CL(计算语言学,全量分类) · arxiv.org