-
公开(公告)号:CN109710761A
公开(公告)日:2019-05-03
申请号:CN201811566673.8
申请日:2018-12-21
Abstract: 本发明涉及一种基于注意力增强的双向LSTM模型的情感分析方法,所述方法采用注意力机制与双向LSTM模型相结合,使用双向LSTM模型学习文本语义信息,使用注意力机制加强对重点词的关注,所述方法包括:首先对输入的句子利用预训练好词向量进行表示,然后分别经过双向LSTM模型和注意力模型学习表示,将两部分表示后的向量拼接,最终通过分类器完成文本情感分析的工作。本发明使用双向LSTM学习文本的语义信息,使用在词向量上建立的自注意力机制加强对句中情感关键词的关注度,本发明采用的词向量注意力机制与双向LSTM为并行结构,实验表明,本发明提出的模型表现出优越的性能,并在多个指标上超过了已知的最好模型,可以很好地满足实际应用的需要。
-
公开(公告)号:CN111985215A
公开(公告)日:2020-11-24
申请号:CN202010841791.6
申请日:2020-08-19
IPC: G06F40/242 , G06F40/289 , G06F40/30 , G06F40/216
Abstract: 本申请公开了一种领域短语词典构建方法,包括:挖掘短语;构建领域词库;构建词典模型。挖掘短语包括:将原始数据进行预处理和分词,随后对分词结果采用相邻词频短语挖掘方法,提取出句子中所有可能出现的短语集合。构建领域词库,包括:使用TF-IDF算法训练短语集合得到带权重的词,再通过权重阈值将词划分为领域相关词和无关词。本申请的领域短语词典构建方法,运用统计词频和词语权重量化短语与领域相关性程度,将深度学习网络与构建领域词典方向相结合,显著提升了领域词典的健壮性,在消费品领域词典构建上有良好的表现,提升了消费品缺陷领域词典的构建效果,能够达到较高的正确率、召回率和F1值。
-
公开(公告)号:CN115858813B
公开(公告)日:2025-05-16
申请号:CN202211628660.5
申请日:2022-12-20
Applicant: 北京信息科技大学 , 北京市工程咨询股份有限公司
IPC: G06F16/36 , G06F18/22 , G06F18/214 , G06F16/35 , G06F16/3329 , G06F40/30
Abstract: 本发明涉及面向工程咨询报告的文本检索方法,以改善工程咨询报告撰写过程中人力成本大、编撰周期过长等问题,包括以下步骤:构建面向工程咨询报告的文本检索语料集,使用语料集微调simCSE对比学习模型,将得到的模型参数初始化Vanilla BERT模型,将语料的文本信息送入Vanilla BERT模型得到语义匹配分数。将文本信息和关键词信息通过SAT模型得到词级粒度的义原词向量表示并送入DRMM深度文本交互模型,得到关联匹配分数。将得到的语义匹配分数和关联匹配分数归一化后加权融合,得到最终的匹配分数,完成标题与段落之间的文本检索。本发明联合上下文向量表示和文本交互匹配方法,有效增强了文本检索的效果。
-
公开(公告)号:CN117710661B
公开(公告)日:2025-04-15
申请号:CN202410009296.7
申请日:2024-01-04
Applicant: 北京信息科技大学
Abstract: 本发明公开了一种基于矩形可变形卷积的遥感图像目标检测方法,属于目标检测技术领域,包括利用遥感图像目标检测数据集训练改进的Oriented RCNN模型;其中,设计矩形可变形卷积替换卷积神经网络中的一般卷积,在特征金字塔网络中加入了高级和低级特征融合模块并应用子像素卷积生成高分辨率特征图,删除检测头的两个共享的全连接层并在分类和回归分支分别使用适配网络,得到改进的Oriented RCNN模型;将改进的Oriented RCNN模型用于遥感图像目标检测中。本发明使用了矩形可变形卷积能够更好地适应遥感图像目标的几何变换,特征融合模块用于检索尺度较小的目标。本发明可获得更好的目标检测精度。
-
公开(公告)号:CN119741625A
公开(公告)日:2025-04-01
申请号:CN202411956595.8
申请日:2024-12-29
Applicant: 北京信息科技大学
Abstract: 本发明公开了一种基于跨头部协同蒸馏与特征标准化的航拍图像目标检测方法,其特征在于,包括:训练教师网络,得到一个准确度较高的教师网络;随机初始化学生网络,输入图像之后通过特征金字塔结构获取教师和学生网络的多尺度特征;使用特征共享标准化层获取标准化的教师和学生网络的特征,并求特征相关性损失;将学生网络头部特征通过共享标准化层输入跨头部输入教师网络头部,求得预测一致性损失;通过标签获取学生网络的有监督损失;根据反向传播的梯度信息更新学生网络的权重值。本发明可以通过跨头标准化的方法提升目标检测模型蒸馏效果,使较少参数量的目标检测学生网络获得和较大参数的教师模型近似的精度。
-
公开(公告)号:CN118093874A
公开(公告)日:2024-05-28
申请号:CN202410275955.1
申请日:2024-03-12
IPC: G06F16/35 , G06F16/33 , G06F18/2415 , G06F40/30 , G06F40/284 , G06N3/0455 , G06N3/047 , G06N3/0442 , G06N3/084
Abstract: 本发明涉及一种低资源语言处理领域的情感分析方法。提出一种基于网格结构与多头注意力的新闻句子情感分析方法。包括以下步骤:通过将网格结构无损转换为扁平结构,实现音节序列中单词信息的引入;采用相对位置编码机制,编码音节和单词的位置和方向信息;使用多头自注意力机制,识别序列中音节和单词的关联关系和语义信息;最后通过全连接层进行分类得到低资源语言新闻句子情感类别。本发明解决了传统循环神经网络无法进行大规模并行计算以及卷积神经网络难以建模句子中的长距离依赖关系的问题,其中多头注意力机制的运用,丰富了词语间的关联关系,增强了句子语义和句法结构信息的理解,提高了低资源语言新闻句子情感分类效果。
-
公开(公告)号:CN117710661A
公开(公告)日:2024-03-15
申请号:CN202410009296.7
申请日:2024-01-04
Applicant: 北京信息科技大学
IPC: G06V10/25 , G06V20/10 , G06V10/80 , G06V10/52 , G06V10/44 , G06V10/764 , G06V10/766 , G06V10/774 , G06V10/776 , G06V10/82 , G06N3/0464 , G06N3/0455 , G06N3/084 , G06N3/048
Abstract: 本发明公开了一种基于矩形可变形卷积的遥感图像目标检测方法,属于目标检测技术领域,包括利用遥感图像目标检测数据集训练改进的Oriented RCNN模型;其中,设计矩形可变形卷积替换卷积神经网络中的一般卷积,在特征金字塔网络中加入了高级和低级特征融合模块并应用子像素卷积生成高分辨率特征图,删除检测头的两个共享的全连接层并在分类和回归分支分别使用适配网络,得到改进的Oriented RCNN模型;将改进的Oriented RCNN模型用于遥感图像目标检测中。本发明使用了矩形可变形卷积能够更好地适应遥感图像目标的几何变换,特征融合模块用于检索尺度较小的目标。本发明可获得更好的目标检测精度。
-
公开(公告)号:CN116029297A
公开(公告)日:2023-04-28
申请号:CN202310061847.X
申请日:2023-02-04
Applicant: 北京信息科技大学 , 复杂系统仿真总体重点实验室
IPC: G06F40/295 , G06V10/40 , G06V10/764 , G06V10/82 , G06N7/01 , G06N3/0464 , G06N3/045 , G06N3/048 , G06N3/08
Abstract: 本发明解决武器装备领域文本数据因其稀缺性,存在噪声大、句子短、质量差、不具备丰富的上下文语义等现象,利用多模态方法可有效提高实体识别的效果,包括以下步骤:由ResNet提取视觉特征,同时对图像进行分类;将分类标签在字典中的解释通过BERT得到向量信息,取到包含全部分类信息的[CLS];由BERT提取整个文本特征,将含有分类信息的[CLS]替换文本向量的[CLS]部分,然后进行自注意力得到关注实体的特征向量;将两种模态处理好的特征向量进行跨模态注意,通过互注意力模块对两种特征向量进行交互感知;最后通过CRF层提取出实体。在武器装备多模态数据集上进行实验,表明本发明优于单文本模态和主流多模态模型,可实现对武器装备领域实体的有效识别。
-
公开(公告)号:CN108920456B
公开(公告)日:2022-08-30
申请号:CN201810611476.7
申请日:2018-06-13
Applicant: 北京信息科技大学
IPC: G06F40/211 , G06F40/216
Abstract: 本发明涉及一种关键词自动抽取方法,包括:抽取技术标准中的通用词,抽取候选关键词,针对候选关键词过滤通用词后,综合位置特征、词共现特征以及上下文语义特征计算候选关键词权重得分,根据候选关键词权重得分范围计算动态阈值,利用动态阈值确定结果关键词。本发明提供的关键词自动抽取方法,融合位置特征、词共现特征以及上下文语义特征抽取关键词,综合考虑文档内部位置以及上下文语义特征对关键词的权重影响,达到了更高的正确率和召回率,提高了3GPP技术标准检索质量,降低了人工成本,可以很好地满足实际应用的需要。
-
公开(公告)号:CN112507080A
公开(公告)日:2021-03-16
申请号:CN202011482957.6
申请日:2020-12-16
Applicant: 北京信息科技大学
IPC: G06F16/33 , G06F40/289 , G06F40/232 , G06F40/166
Abstract: 本申请公开了一种文字识别矫正的方法,包括:构建专业词库;构建识别结果区域矩阵;矫正。本申请的文字识别矫正的方法,通过引入语言模型,统计条件概率预测最佳符合词库的识别结果,通过检测项对应关系,进行前后矫正,进一步提高识别精确度,最后通过融合编辑距离和最长公共子序列的识别方法匹配最佳的识别结果,提高了识别准确率,能够很好地满足实际应用的需要。
-
-
-
-
-
-
-
-
-