跳到正文
热点事件持续更新

自监督语音模型识别未见搭嘴音研究

1 篇报道1 个报道来源3 小时前更新

先了解这件事

AI 综述

Chihiro Taguchi 等人发表研究称,预训练自监督语音模型 Wav2Vec2 与 HuBERT 在两种搭嘴音丰富的科伊桑语(G|ui 与 West !Xoon)上微调后,识别搭嘴音的准确率始终高于非搭嘴音。 研究据此认为,自监督学习能让模型泛化到包括罕见音素在内的人类语音。该工作发表于 Interspeech 2026。

AI 根据报道生成 · 1 小时前更新

报道时间线

沿着报道,了解事件的不同侧面。

10月9日
  1. arXiv:cs.CL
    预训练自监督语音模型 Wav2Vec2 与 HuBERT 能识别未见过的搭嘴音

    预训练自监督语音模型 Wav2Vec2 和 HuBERT 在两种搭嘴音丰富的科伊桑语(G|ui 与 West !Xoon)上微调后,识别搭嘴音的准确率始终高于非搭嘴音。研究结果提示,自监督学习能让模型泛化到包括罕见音素在内的人类语音。该工作发表于 Interspeech 2026。

本事件热度走势

还没有足够的连续观测数据,暂不绘制趋势。