-
公开(公告)号:CN112712096A
公开(公告)日:2021-04-27
申请号:CN201911022350.7
申请日:2019-10-25
Applicant: 中国科学院声学研究所 , 国家计算机网络与信息安全管理中心
Abstract: 本发明公开了基于深度递归非负矩阵分解的音频场景分类方法及系统,该方法包括:将待分类的音频信号按照贝叶斯信息准则进行音频场景切分;将切分后的每一段音频划分为多个块,每个块包括多个音频帧;以块为单位分别输入多个预先训练好的深度递归NMF网络,得到每块音频在不同子空间中的展开特征;将不同子空间中的展开特征拼接为一个长特征向量,输入支持向量机,获得每块音频的类别判别结果;计算该段音频所有块的类别判别结果的均值,由此得到该段音频的所属类别。本发明的方法将深度NMF用于音频场景分类,通过探索相邻帧之间NMF系数的递归关系,降低模型复杂度,提高泛化能力。
-
公开(公告)号:CN110266902B
公开(公告)日:2021-04-02
申请号:CN201910444314.3
申请日:2019-05-27
Applicant: 国家计算机网络与信息安全管理中心 , 南京中新赛克科技有限责任公司
Abstract: 本发明公开了一种VoIP信令与媒体数据关联系统、方法及计算机存储介质,系统包括识别过滤装置、解析处理装置、核心关联装置和数据分析反馈装置,方法上采用多维度数据对互联网VoIP网络电话协议信令与媒体数据进行关联。本发明从功能上,既保证了关联结果的高质量性,又保证关联结果的高数量性;从可靠性上,对关联结果的后续分析并将分析结果反馈给关联使用,逐步优化系统的关联效果;从可扩展性上,采用多装置处理的方式,使得需要拓展功能时,只需要修改或者扩展单装置功能而不影响整体的功能以及效果。
-
公开(公告)号:CN111625661A
公开(公告)日:2020-09-04
申请号:CN202010408234.5
申请日:2020-05-14
Applicant: 国家计算机网络与信息安全管理中心
IPC: G06F16/45 , G06F16/483 , H04N21/845 , G06N3/04 , G06N3/08
Abstract: 本发明实施例公开了一种音视频片段分类方法及装置,所述方法包括:基于待分类音视频片段的视频帧序列提取目标视频帧,基于待分类音视频片段的音频帧序列提取目标音频帧;基于目标视频帧/目标音频帧的第一出现时刻/第二出现时刻及预设子片段时长确定第一音视频子片段/第二音视频子片段;基于第一音视频子片段/第二音视频子片段提取第一视频分量特征和第一音频分量特征/第二视频分量特征和第二音频分量特征;通过预设音视频分类模型基于第一视频分量特征、第一音频分量特征、第二视频分量特征和第二音频分量特征确定待分类音视频片段的音视频分类结果。采用本发明可以提高音视频分类效率,提高音视频分类的鲁棒性和准确率。
-
公开(公告)号:CN111354347A
公开(公告)日:2020-06-30
申请号:CN201811571564.5
申请日:2018-12-21
Applicant: 中国科学院声学研究所 , 国家计算机网络与信息安全管理中心
IPC: G10L15/08
Abstract: 本发明提出了一种基于自适应热词权重的语音识别方法及系统,所述方法包括:生成热词网络并和静态解码网络一起加载到语音识别解码器中;将待识别的语音信号同步地在静态解码网络和热词网络上进行令牌传递,自适应地计算热词权重,并对静态解码网络上令牌的分数重新打分;输出解码结果。本发明的基于自适应热词权重的语音识别方法在一遍解码的过程中就能提升热词召回率,不影响解码的速度,并且自适应地计算热词权重既能有效地提高热词的召回率,不影响原先的解码速度,又能提高系统的鲁棒性。
-
公开(公告)号:CN111341319A
公开(公告)日:2020-06-26
申请号:CN201811559040.4
申请日:2018-12-19
Applicant: 中国科学院声学研究所 , 国家计算机网络与信息安全管理中心
Abstract: 本发明公开了一种基于局部纹理特征的音频场景识别方法,所述方法包括:将待识别的音频信号进行预处理后逐帧提取Mel-fbank特征和描述局部纹理的LTP特征;进行融合后输入预先训练得到的时延深度神经网络模型;得到对应于不同音频场景类型的后验概率;采用后处理决策机制处理后验概率获取待识别音频信号对应的音频场景标签。本发明的音频场景识别方法,基于对场景时频信息的有效表征,更好地实现了音频场景种类的识别。
-
公开(公告)号:CN110719592A
公开(公告)日:2020-01-21
申请号:CN201910992033.1
申请日:2019-10-18
Applicant: 国家计算机网络与信息安全管理中心
IPC: H04W12/12
Abstract: 一种兼容4G和5G网络的防范诈骗电话的系统与方法,包括:业务管理装置,将通话检测策略数据下发给汇聚装置,并接收汇聚装置上传的呼叫数据;汇聚装置,根据通话检测策略数据,从样本数据中提取特征信息,并加密,再将加密后的通话检测策略数据和特征信息发给各个前端接入装置;同时,将各个前端接入装置发来的呼叫数据还原后回传给业务管理装置;前端接入装置,根据收到的通话检测策略数据,对触发至核心网元的呼叫进行信令的实时解析,并将符合通话检测策略的呼叫数据回传给汇聚装置。本发明属于信息技术领域,能构建一套兼容4G并适配5G分组化、扁平化网络下的诈骗电话防范网络,保障不断演进的电信网络架构下的通信安全。
-
公开(公告)号:CN110708418A
公开(公告)日:2020-01-17
申请号:CN201910848492.2
申请日:2019-09-09
Applicant: 国家计算机网络与信息安全管理中心 , 北京邮电大学
Abstract: 本发明公开了一种识别呼叫方属性的方法及装置,涉及通信技术领域,包括:接收到第二设备的通话请求后,与所述第二设备建立通话连接;获取所述第二设备发送的语音数据;提取所述语音数据的噪声特征,作为待处理噪声特征;所述噪声特征包括以下任意一项或多项:期望、熵和超熵;在预先建立的噪声特征与属性标签的对应关系中,查找所述待处理噪声特征对应的属性标签,作为所述第二设备的第一属性。本发明通过噪声特征来识别呼叫方的属性,相比于现有技术提升了识别准确性。
-
公开(公告)号:CN110556114A
公开(公告)日:2019-12-10
申请号:CN201910684343.7
申请日:2019-07-26
Applicant: 国家计算机网络与信息安全管理中心 , 北京邮电大学
Abstract: 本发明公开了一种基于注意力机制的说话人识别方法及装置,包括如下步骤:采集多个被测试通话人的通话录音和测试通话人的通话录音;根据所述被测试通话人对应的通话录音,建立通话人语音库;采用基于注意力的神经网络对所述被测试通话人语音进行训练,获得训练模型;存储所述测试通话人的通话录音,获得录音文件;将所述录音文件采用所述训练模型识别所述被测试通话人是否目标通话人。通过采用基于注意力的神经网络对所述被测试通话人语音进行训练,获得训练模型,采用训练模型识别所述被测试通话人,确认了拨号码对应的主人的一致性,避免了由于通话人身份被仿冒带来的通信安全隐患,进一步提高了通话过程中的信息的安全性。
-
公开(公告)号:CN110545359A
公开(公告)日:2019-12-06
申请号:CN201910713518.2
申请日:2019-08-02
Applicant: 国家计算机网络与信息安全管理中心 , 北京邮电大学
IPC: H04M3/22
Abstract: 本发明公开了一种通信线路特征提取方法、通信线路识别方法及装置。所述方法包括:通过运营商通信线路建立位于主叫地的主叫终端与位于被叫地的被叫终端之间的通话连接;在所述主叫终端处播放语音;在所述被叫终端处获取所述语音对应的音频;从所述音频中提取音频特征作为通信线路特征,所述通信线路特征为所述主叫地与所述被叫地之间的所述运营商通信线路的特征,从而有助于准确且高效的识别相应的运营商和来源地,进而提高用户通话的可靠性。
-
公开(公告)号:CN111625661B
公开(公告)日:2023-09-08
申请号:CN202010408234.5
申请日:2020-05-14
Applicant: 国家计算机网络与信息安全管理中心
IPC: G06F16/45 , G06F16/483 , H04N21/845 , G06V10/82 , G06N3/0464 , G06N3/0442 , G06N3/045 , G06N3/084
Abstract: 本发明实施例公开了一种音视频片段分类方法及装置,所述方法包括:基于待分类音视频片段的视频帧序列提取目标视频帧,基于待分类音视频片段的音频帧序列提取目标音频帧;基于目标视频帧/目标音频帧的第一出现时刻/第二出现时刻及预设子片段时长确定第一音视频子片段/第二音视频子片段;基于第一音视频子片段/第二音视频子片段提取第一视频分量特征和第一音频分量特征/第二视频分量特征和第二音频分量特征;通过预设音视频分类模型基于第一视频分量特征、第一音频分量特征、第二视频分量特征和第二音频分量特征确定待分类音视频片段的音视频分类结果。采用本发明可以提高音视频分类效率,提高音视频分类的鲁棒性和准确率。
-
-
-
-
-
-
-
-
-