WhisperX: Time-Accurate Speech Transcription of Long-Form Audio

WhisperX: Time-Accurate Speech Transcription of Long-Form Audio
复制标题

WhisperX:长格式音频的时间精确语音转录

DOI:
10.21437/interspeech.2023-78
复制
发表时间:
2023
期刊:
--
影响因子:
--
通讯作者:
Bain M
Bain M
中科院分区:
--
文献类型:
--
作者:
Bain M

文献摘要

参考文献

被引文献

相似文献

VoxPopuli:用于表征学习、半监督学习和解释的大规模多语言语音语料库
DOI: 10.18653/v1/2021.acl-long.80
发表时间: 2021
期刊: ArXiv
影响因子: --
作者:
Changhan Wang;M. Rivière;Ann Lee;Anne Wu;Chaitanya Talnikar;Daniel Haziza;Mary Williamson;J. Pino;Emmanuel Dupoux
通讯作者: Emmanuel Dupoux
结合基于 HMM 的方法和光谱边界校正的自动分割
DOI: --
发表时间: 2002
期刊: Interspeech
影响因子: --
作者:
Yeon;Alistair Conkie
通讯作者: Alistair Conkie
DOI: 10.1109/taslp.2021.3122291
发表时间: 2021-01-01
影响因子: 5.4
作者:
Hsu, Wei-Ning;Bolte, Benjamin;Mohamed, Abdelrahman
通讯作者: Mohamed, Abdelrahman
使用 wav2vec 2.0 对脑瘫患者使用未标记语音进行语音识别
DOI: --
发表时间: 2022
期刊:
影响因子: --
作者:
松坂 勇樹;高島 遼一;滝口 哲也
通讯作者: 滝口 哲也
使用混合不变训练的无监督声音分离
DOI: --
发表时间: 2020
期刊: Neural Information Processing Systems
影响因子: --
作者:
Scott Wisdom;Efthymios Tzinis;Hakan Erdogan;Ron J. Weiss;K. Wilson;J. Hershey
通讯作者: J. Hershey