跳到正文
热点事件持续更新

EMODE情感感知语音语言模型论文发布

1 篇报道1 个报道来源5 小时前更新

先了解这件事

AI 综述

Jianan Pan等作者提交并发布EMODE情感感知语音语言模型论文,该模型以动态副语义专家(DPSE)为核心,将连续语音特征分解为语义与副语言两条路径,动态路由并在融入语言模型前融合。 据论文称,EMODE采用语义预热、副语言激活、联合精炼三阶段课程训练,并引入OEG、SAA和GDR三项引导机制,同时新建双语MEPA基准。 论文报告称,在SER测试、共情回复评估及MEPA基准上,EMODE改善了词汇保真度与情感敏感度的平衡,并增强了基于情感的回复生成;这些效果均为作者在论文中的报告。

AI 根据报道生成 · 2 小时前更新

报道时间线

沿着报道,了解事件的不同侧面。

10月7日
  1. arXiv:cs.CL
    EMODE:面向情感感知语音语言建模的动态副语义专家

    EMODE 是一个基于动态副语义专家(DPSE)的情感感知语音语言模型,DPSE 将连续语音特征分解为语义与副语言两条路径,动态路由并在融入语言模型前融合。该模型采用语义预热、副语言激活、联合精炼三阶段课程训练,并引入 OEG、SAA 和 GDR 三项引导机制。在 SER 测试、共情回复评估及新建双语 MEPA 基准上,EMODE 改善了词汇保真度与情感敏感度的平衡,并增强了基于情感的回复生成。

本事件热度走势

还没有足够的连续观测数据,暂不绘制趋势。