一种视频新闻实时转写存储方法及系统技术方案

技术编号:14772865 阅读:73 留言:0更新日期:2017-03-09 10:39
本发明专利技术公开了一种视频新闻实时转写存储系统,通过本地客户端将直播视频流转换为视频文件存储,并提取其中的音频文件,发送到语音识别服务器进行转写,得到文字信息返回到本地客户端,本地客户端将接收到的文字信息与视频文件进行合成,生成带字幕的视频文件,供用户查看,使无法及时观看新闻直播的用户可在空闲时观看,并且提供字幕,方便聋哑人阅读新闻;同时,本地客户端将文字信息单独保存为文本文件,存储在本地硬盘内,供用户查阅,为没有时间观看视频的用户提供文字阅读新闻,为用户实时阅读新闻提供便利。

【技术实现步骤摘要】

本专利技术属于语音识别
,涉及一种新闻转写方法及系统,具体是一种视频新闻实时转写存储方法及系统
技术介绍
新闻直播,指不经过预先录音或者录像将事件现场情况、演播室播讲或表演同步播出的广播电视传播形式。视频新闻直播一般通过流媒体服务器向用户在线直播新闻,用户通过客户端观看视频新闻,但是,当用户因一些原因无法实时观看视频新闻,用户又想了解新闻内容时,需要提供一种可将视频新闻直播实时存储,并转写为文本,提供文字阅读和视频观看两种方式供用户选择的系统,本案由此产生。
技术实现思路
本专利技术的目的在于提供一种操作简单、使用方便的视频新闻实时转写存储方法及系统。本专利技术的目的可以通过以下技术方案实现:一种视频新闻实时转写存储方法,包括以下步骤:步骤S1,视频新闻通过流媒体服务器输出视频流到本地客户端进行播放;步骤S2,本地客户端对接收到的视频流进行编码,生成视频文件存储在本地硬盘内;步骤S3,本地客户端通过音频提取模块对视频文件进行处理,提取其中的音频数据,生成音频文件;步骤S4,本地客户端将音频文件发送到语音识别服务器,语音识别服务器对音频文件进行转写,生成文字信息;步骤S5,语音识别服务器通过文字校正模块对文字信息进行校正,并将校正后的文字信息发送到本地客户端;步骤S6,本地客户端将接收到的文字信息与视频文件进行合成,生成带字幕的视频文件,同时将文字信息单独保存为文本文件,存储在本地硬盘内,供用户查阅。一种视频新闻实时转写存储系统,包括通过网络连接的流媒体服务器、本地客户端和语音识别服务器;所述的流媒体服务器,接收到新闻现场的实时视频信号,并以流式协议向本地客户端进行直播,输出视频流到本地客户端;所述的本地客户端包括视频编码模块,用于对接收到的视频流进行编码,生成视频文件;本地硬盘,用于存储视频文件和文本文件;音频提取模块,用于对生成的视频文件进行处理,提取其中的音频数据,生成音频文件,并发送到语音识别服务器;文本编辑模块,用于接收语音识别服务器返回的文字信息,并对文字信息进行处理,生成文本文件,存储到本地硬盘;以及字幕嵌入模块,用于接收语音识别服务器返回的文字信息,并对文字信息进行处理,生成字幕文件,并将字幕文件嵌入视频文件内,生成带字幕的视频文件;所述的语音识别服务器包括语音识别模块,用于接收本地客户端发送的音频文件,并对音频文件的声音信息进行识别,转写为文字信息;语义理解模块,根据转写的文字信息,判断文字的内涵,理解新闻的真实意义,输出语义理解信息;文字校正模块,根据语音识别模块转写的文字信息和语义理解模块的输出的语义理解信息,对转写文字进行校正,并发送到本地客户端。进一步地,所述的语音识别服务器采用讯飞在线语音识别服务器。本专利技术的有益效果:本专利技术提供的一种视频新闻实时转写存储系统,通过本地客户端将直播视频流转换为视频文件存储,并提取其中的音频文件,发送到语音识别服务器进行转写,得到文字信息返回到本地客户端,本地客户端将接收到的文字信息与视频文件进行合成,生成带字幕的视频文件,供用户查看,使无法及时观看新闻直播的用户可在空闲时观看,并且提供字幕,方便聋哑人阅读新闻;同时,本地客户端将文字信息单独保存为文本文件,存储在本地硬盘内,供用户查阅,为没有时间观看视频的用户提供文字阅读新闻,为用户实时阅读新闻提供便利。附图说明下面结合附图和具体实施例对本专利技术作进一步详细描述。图1是本专利技术的系统示意图。具体实施方式下面将结合本专利技术实施例中的附图,对本专利技术实施例中的技术方案进行清楚、完整地描述,显然,所描述的实施例仅仅是本专利技术一部分实施例,而不是全部的实施例。基于本专利技术中的实施例,本领域普通技术人员在没有作出创造性劳动前提下所获得的所有其它实施例,都属于本专利技术保护的范围。本专利技术提供了一种视频新闻实时转写存储方法,包括以下步骤:步骤S1,视频新闻通过流媒体服务器输出视频流到本地客户端进行播放。步骤S2,本地客户端对接收到的视频流进行编码,生成视频文件存储在本地硬盘内。步骤S3,本地客户端通过音频提取模块对视频文件进行处理,提取其中的音频数据,生成音频文件。步骤S4,本地客户端将音频文件发送到语音识别服务器,语音识别服务器对音频文件进行转写,生成文字信息。步骤S5,语音识别服务器通过文字校正模块对文字信息进行校正,并将校正后的文字信息发送到本地客户端。步骤S6,本地客户端将接收到的文字信息与视频文件进行合成,生成带字幕的视频文件,同时将文字信息单独保存为文本文件,存储在本地硬盘内,供用户查阅。如图1所示,一种视频新闻实时转写存储系统,包括通过网络连接的流媒体服务器、本地客户端和语音识别服务器,本地客户端安装在用户本地计算机内。流媒体服务器,接收到新闻现场的实时视频信号,并以流式协议(RTP/RTSP、MMS、RTMP等)向本地客户端进行直播,输出视频流到本地客户端。本地客户端包括视频编码模块、本地硬盘、音频提取模块、文本编辑模块以及字幕嵌入模块。视频编码模块,用于对接收到的视频流进行编码,生成视频文件。本地硬盘,用于存储视频文件和文本文件。音频提取模块,用于对生成的视频文件进行处理,提取其中的音频数据,生成音频文件,并发送到语音识别服务器。文本编辑模块,用于接收语音识别服务器返回的文字信息,并对文字信息进行处理,生成文本文件。字幕嵌入模块,用于接收语音识别服务器返回的文字信息,并对文字信息进行处理,生成字幕文件,并将字幕文件嵌入视频文件内,生成带字幕的视频文件。语音识别服务器,使用讯飞在线语音识别服务器,包括语音识别模块、语义理解模块以及文字校正模块。语音识别模块,用于接收本地客户端发送的音频文件,并对音频文件的声音信息进行识别,转写为文字信息。语义理解模块,根据转写的文字信息,基于场景应用技术,判断文字的内涵,理解新闻的真实意义,输出语义理解信息。文字校正模块,根据语音识别模块转写的文字信息和语义理解模块的输出的语义理解信息,对转写文字进行校正,并发送到本地客户端。本专利技术提供的一种视频新闻实时转写存储系统,通过本地客户端将直播视频流转换为视频文件存储,并提取其中的音频文件,发送到语音识别服务器进行转写,得到文字信息返回到本地客户端,本地客户端将接收到的文字信息与视频文件进行合成,生成带字幕的视频文件,供用户查看,使无法及时观看新闻直播的用户可在空闲时观看,并且提供字幕,方便聋哑人阅读新闻;同时,本地客户端将文字信息单独保存为文本文件,存储在本地硬盘内,供用户查阅,为没有时间观看视频的用户提供文字阅读新闻,为用户实时阅读新闻提供便利。为了描述的方便,描述以上装置时以功能分为各种单元、模块分别描述。当然,在实施本申请时可以把各单元、模块的功能在同一个或多个软件和/或硬件中实现。通过以上的实施方式的描述可知,本领域的技术人员可以清楚地了解到本申请可借助软件加必需的通用硬件平台的方式来实现。基于这样的理解,本申请的技术方案本质上或者说对现有技术做出贡献的部分可以以软件产品的形式体现出来,该计算机软件产品可以存储在存储介质中,如ROM/RAM、磁碟、光盘等,包括若干指令用以使得一台计算机设备(可以是个人计算机,服务器,或者网络设备等)执行本申请各个实施方式或者实施方式的某些部分所述的方法。以上所描述的装置实施方本文档来自技高网...
一种视频新闻实时转写存储方法及系统

【技术保护点】
一种视频新闻实时转写存储方法,其特征在于,包括以下步骤:步骤S1,视频新闻通过流媒体服务器输出视频流到本地客户端进行播放;步骤S2,本地客户端对接收到的视频流进行编码,生成视频文件存储在本地硬盘内;步骤S3,本地客户端通过音频提取模块对视频文件进行处理,提取其中的音频数据,生成音频文件;步骤S4,本地客户端将音频文件发送到语音识别服务器,语音识别服务器对音频文件进行转写,生成文字信息;步骤S5,语音识别服务器通过文字校正模块对文字信息进行校正,并将校正后的文字信息发送到本地客户端;步骤S6,本地客户端将接收到的文字信息与视频文件进行合成,生成带字幕的视频文件,同时将文字信息单独保存为文本文件,存储在本地硬盘内,供用户查阅。

【技术特征摘要】
1.一种视频新闻实时转写存储方法,其特征在于,包括以下步骤:步骤S1,视频新闻通过流媒体服务器输出视频流到本地客户端进行播放;步骤S2,本地客户端对接收到的视频流进行编码,生成视频文件存储在本地硬盘内;步骤S3,本地客户端通过音频提取模块对视频文件进行处理,提取其中的音频数据,生成音频文件;步骤S4,本地客户端将音频文件发送到语音识别服务器,语音识别服务器对音频文件进行转写,生成文字信息;步骤S5,语音识别服务器通过文字校正模块对文字信息进行校正,并将校正后的文字信息发送到本地客户端;步骤S6,本地客户端将接收到的文字信息与视频文件进行合成,生成带字幕的视频文件,同时将文字信息单独保存为文本文件,存储在本地硬盘内,供用户查阅。2.一种视频新闻实时转写存储系统,其特征在于:包括通过网络连接的流媒体服务器、本地客户端和语音识别服务器;所述的流媒体服务器,接收到新闻现场的实时视频信号,并以流式协议向本地客户端进行直播,输出视频流到本地客户端;所述的本地客户端包括视频编码...

【专利技术属性】
技术研发人员:虞焰兴
申请(专利权)人:安徽声讯信息技术有限公司
类型:发明
国别省市:安徽;34

网友询问留言 已有0条评论
  • 还没有人留言评论。发表了对其他浏览者有用的留言会获得科技券。

1