本发明揭示了一种中文在线音视频的字幕生成方法,包括如下步骤:S1、音频数据提取步骤,服务器接收音视频文件、提取音频数据并转化为标准格式;S2、降噪步骤,对音频数据进行降噪处理,得到音频文件;S3、数据切分步骤,对音频文件进行端点切分,得到音频样本;S4、片段识别步骤,对所得到的音频样本进行进一步切分,得到语音片段,再对语音片段进行识别,整理得到全部音频数据的识别结果;S5、字幕生成步骤,整合分析出文本及对应的时间轴,得到字幕文件,按照生成的字幕文件将字幕与音频数据进行匹配。本发明的方法可以自动完成音视频信息的语音识别和字幕生成工作,有效地弥补了传统的人工速记在字幕生成工作中转换效率上的不足。
📄 2018111072251
📂 H04N5_278
👤 南京邮电大学
📅 2018-09-21