跳到正文
热点事件持续更新

生物医学多模态持续预训练新语料与框架

1 篇报道1 个报道来源2 小时前更新

先了解这件事

AI 综述

研究人员提出名为上下文锚定重建的框架,将 PMC-OA 文献转化为指代连贯的交错序列,并据此构建了 9.63B token 的 PMC-InterCPT 语料,用于医学多模态大模型的持续预训练。 上述内容来自该论文在 arXiv 计算语言学分类下的发布,目前仅为方法提出,尚无论文所述效果的验证结果。

AI 根据报道生成 · 53 分钟前更新

报道时间线

沿着报道,了解事件的不同侧面。

10月8日
  1. arXiv:cs.CL
    PMC-InterCPT:面向生物医学多模态持续预训练的上下文锚定重建方法

    研究人员提出上下文锚定重建框架,将 PMC-OA 文献转化为指代连贯的交错序列,并据此构建 9.63B token 的 PMC-InterCPT 语料用于医学多模态大模型持续预训练。

本事件热度走势

还没有足够的连续观测数据,暂不绘制趋势。