-
公开(公告)号:CN113269691B
公开(公告)日:2022-10-21
申请号:CN202110584825.2
申请日:2021-05-27
Applicant: 北京卫星信息工程研究所 , 哈尔滨工程大学
IPC: G06T5/00 , G06N3/04 , G06N3/08 , G06V10/774
Abstract: 本发明公开的属于SAR图像去噪方法技术领域,具体为一种基于卷积稀疏进行噪声仿射拟合的SAR图像去噪方法,该基于卷积稀疏进行噪声仿射拟合的SAR图像去噪方法的具体实施方案如下:利用图像增广和图像重进消除噪声特性对于模型训练过程的影响,本发明构建的网络具有训练初期收敛效率高,末期收敛情况与其他基准模型相同的特征,利用稀疏表示与卷积滤波器的特性,进一步节省了训练时间,提高了模型的迭代效率,借助图像增广丰富数据以及图像重建消除噪声特性的设计,本发明有效地降低了SAR图像去噪过程对无噪声SAR图像的需求度,减少了实际任务中在无噪声SAR图像获取过程投入的开支,并取得更为优秀的SAR图像去噪效果。
-
公开(公告)号:CN112562707A
公开(公告)日:2021-03-26
申请号:CN202011376572.1
申请日:2020-11-30
Applicant: 哈尔滨工程大学
IPC: G10L21/02 , G10L21/0208
Abstract: 本发明提供一种单信道目标语音增强方法,包括如下步骤:步骤一:语音信号的预处理与特征转换,引入时间潜在域信息,将时序波形信息通过深度学习框架拓展映射到对应潜在空间域的过程及其逆向变换;步骤二:基于生成信号权重的目标函数;步骤三:引入时序TCN网络模型;本发明网络能实现从混合源语音到目标语音信号的端到端处理,网络的增强性能优秀,能良好还原目标语音信号,同时提升了数据处理的并行处理能力,并能通过自身的数据增广丰富样本集,提升模型性能。
-
公开(公告)号:CN112562706A
公开(公告)日:2021-03-26
申请号:CN202011376556.2
申请日:2020-11-30
Applicant: 哈尔滨工程大学
IPC: G10L21/02 , G10L21/0208 , G10L25/03
Abstract: 本发明提供一种基于时间潜在域特定说话人信息的目标语音提取方法,包括时间潜在域特征转换模型、目标说话人特征信息指导器与增强提取模块;待处理的复杂声学环境语音信息经过时间潜在域特征转换模型的处理将映射到潜在空间的特征矩阵,此特征矩阵将分别进入目标说话人特征信息指导器与增强提取模块;在目标说话人特征信息指导器中,特征矩阵将被判定为与某一特定的目标说话人潜在特征具有相关性,或者不包含目标说话人特征。本发明能实现从复杂声学环境语音信号到特定目标语音信号的端到端处理,能高效提取出针对特定任务的目标说话人信息,而不受其他干扰信号的影响,保障了模型传递给后续任务的特定目标语音信号具备极高的语音质量与可感知性。
-
-