-
公开(公告)号:CN119940360A
公开(公告)日:2025-05-06
申请号:CN202510203852.9
申请日:2025-02-24
Applicant: 国家计算机网络与信息安全管理中心 , 北京中科闻歌科技股份有限公司
IPC: G06F40/284 , G06F40/216 , G06F40/166 , G06F16/35 , G06N3/045 , G06N3/08
Abstract: 本发明提供了一种基于大语言模型的企业文本数据多维处理方法和电子设备,包括:获取待处理文本数据中的关键词和对应的权重,并将获取的关键词按照权重由大到小的顺序进行重排序,得到排序后的关键词;为排序后的关键词赋予新权重,作为该关键词的最终权重;基于每个关键词对应的最终权重,从待处理文本数据中获取对应的上下文内容,作为对应的文本片段;利用多个文本分类模型对每个文本片段的类别标签进行预测,类别标签包括表征文本数据为正常文本数据的第一标签和表征文本数据为异常文本数据的第二标签。本发明基于关键词抽取和重排序进行数据处理,融合多种方式进行多维度分类,能够提高异常文本数据识别的准确率和增强泛化能力和鲁棒性。
-
公开(公告)号:CN114819432B
公开(公告)日:2025-04-11
申请号:CN202110065882.X
申请日:2021-01-18
Applicant: 国家计算机网络与信息安全管理中心
IPC: G06Q10/0635
Abstract: 本发明实施例涉及一种企业非法集资风险预测方法、装置、电子设备及存储介质,所述方法包括:获取待进行非法集资风险预测的目标企业的企业数据;对所述企业数据进行特征提取,得到所述目标企业的企业特征;将所述企业特征输入至至少一个已训练的非法集资风险预测模型,得到至少一个所述目标企业非法集资的风险概率;根据至少一个所述目标企业非法集资的风险概率确定所述目标企业是否存在非法集资风险。由此,可以提高对企业非法集资风险进行预测的预测结果的准确性。
-
公开(公告)号:CN114817485B
公开(公告)日:2024-09-06
申请号:CN202110078586.3
申请日:2021-01-20
Applicant: 国家计算机网络与信息安全管理中心
IPC: G06F16/332 , G06F16/35 , G06F18/241
Abstract: 本发明实施例涉及一种非法集资线索识别方法、装置、电子设备及存储介质,所述方法包括:获取多个待进行非法集资线索识别的目标文本数据;基于预设的线索特征规则库从多个所述目标文本数据中确定疑似非法集资线索数据;将所述疑似非法集资线索数据输入至至少一个已训练的非法集资线索分类模型,得到至少一个预测参数;依据所述疑似非法集资线索数据与所述疑似非法集资线索数据对应的至少一个所述预测参数构建非法集资线索数据库。由此,可以提高从海量互联网数据中筛选非法集资线索数据的效率,以及提高最终筛选出的非法集资线索数据的准确性、全面性。
-
公开(公告)号:CN118331972A
公开(公告)日:2024-07-12
申请号:CN202410342318.1
申请日:2024-03-25
Applicant: 国家计算机网络与信息安全管理中心 , 莫荻 , 孙润涛
Abstract: 本发明提供了一种基于账本分叉的链上数字内容模拟方法及装置,适用于以太网,采用基于账本分叉,综合链下情报收集、链上数据分析、合约代码静态分析等技术,进行链上数字内容演化模拟,降低了动态NFT演化分析的手续费、运行时间等成本,通过链下情报、链上交易行为统计、源代码静态分析等方式,在对合约的功能特征进行刻画的基础上,提供集成的演化模拟分析环境,提高了操作效率。
-
公开(公告)号:CN110837608B
公开(公告)日:2024-04-12
申请号:CN201911080716.6
申请日:2019-11-07
Applicant: 中科天玑数据科技股份有限公司 , 国家计算机网络与信息安全管理中心
IPC: G06F16/9538 , G06F16/951
Abstract: 本发明提供了一种基于多源数据的舆情话题传播路径分析系统,包括:多源数据采集模块,用于对舆情话题进行多源数据采集,获取至少一项来源信息;传播路径分析模块,用于根据来源信息的类型采用不同的单源传播路径建立方案,得到单源传播路径,多个单源传播路径相互关联,得到交叉传播路径;传播主路径分析模块,用于分析各个节点的转发关系和转发量,得到舆情话题的关键传播节点,保留根节点与关键传播节点、关键传播节点之间的传播路径,删掉无关路径,得到传播主路径;路径显示模块,用于显示路径信息。本发明还提供了一种基于多源数据的舆情话题传播路径分析方法,帮助用户更加直观的了解舆情话题的传播情况。
-
公开(公告)号:CN117609497A
公开(公告)日:2024-02-27
申请号:CN202311343043.5
申请日:2023-10-17
Applicant: 国家计算机网络与信息安全管理中心 , 中网数安(北京)科技有限公司 , 联洋国融(北京)科技有限公司
IPC: G06F16/35 , G06F18/214 , G06F18/22 , G06F18/2431
Abstract: 本发明提供一种文本有害内容无监督识别方法及装置。所述方法包括:获取待识别的多个文本,计算每个待识别文本的特征向量;计算有害文本分类库中每个有害文本类别的特征向量,有害文本分类库包括每种有害文本类别的标识词;计算待识别文本的特征向量与每个有害文本类别的特征向量的相似度,若所述相似度的最大值超过设定阈值,则所述最大值对应的有害文本类别为所述待识别文本的类别。本发明通过构建有害文本分类库,并通过相似度计算,能够对文本中的有害内容进行无监督识别,解决了基于有监督学习的现有识别方法存在的需要不断地对新的大量文本数据进行标注,耗费大量的人工和时间的问题。
-
公开(公告)号:CN115271324A
公开(公告)日:2022-11-01
申请号:CN202210649136.X
申请日:2022-06-09
Applicant: 国家计算机网络与信息安全管理中心 , 北京中科闻歌科技股份有限公司
IPC: G06Q10/06
Abstract: 本公开实施例提供一种集团风险监测预警方法、装置、设备和存储介质。集团风险预警方法,包括:确定集团包含的企业,以及集团内企业之间的关联关系;根据所述关联关系,基于所述集团内问题企业的第一风险指数进行风险传导,确定所述集团内企业的第二风险指数;基于所述集团内企业的第二风险指数,确定是否触发对所述集团的风险预警。采用本公开实施例提供的方案能够实现自动的集团风险预警,提高了风险预警的实时性。
-
公开(公告)号:CN114861661A
公开(公告)日:2022-08-05
申请号:CN202110077227.6
申请日:2021-01-20
Applicant: 国家计算机网络与信息安全管理中心
IPC: G06F40/295 , G06N3/04 , G06N3/08 , G06Q40/00
Abstract: 本申请涉及一种实体识别方法、装置、设备及存储介质。该方法包括获取非法集资线索数据;确定与非法集资线索数据对应的字向量序列;利用预先训练得到的BiLSTM‑CRF模型对字向量序列进行推理,得到与非法集资线索数据对应的标签序列;从标签序列中提取属于实体标签的目标标签,并将目标标签对应的数据作为非法集资线索数据中的非法集资线索实体。可见,采用本申请的技术方案实现了对非法集资线索实体的自动识别,不仅识别效率高,且可以做到实时识别。
-
公开(公告)号:CN113378090A
公开(公告)日:2021-09-10
申请号:CN202110445408.X
申请日:2021-04-23
Applicant: 国家计算机网络与信息安全管理中心
IPC: G06F16/958 , G06F16/35 , G06F40/284 , G06N3/04 , G06N3/08
Abstract: 本发明公开了一种互联网网站相似度分析方法、装置以及可读存储介质,方法包括:从多个未分类的互联网网站中提取文本特征词;将各个未分类的互联网网站的文本特征词分别输入预先获取到的孪生网络编码工具,得到各个未分类的互联网网站的文本向量序列,其中:所述孪生网络编码工具是从训练好的孪生网络中的输入层至权值共享循环神经网络层进行迁移得到,且所述孪生网络的训练是基于从多个已分类的互联网网站中提取的文本特征词实现;将各个未分类的互联网网站的文本向量序列组成的矩阵进行降维处理得到低维弱相关矩阵;对低维弱相关矩阵进行聚类分析,根据聚类分析结果获取所述多个未分类的互联网网站的相似度情况,从而实现互联网网站相似度分析。
-
公开(公告)号:CN106960672B
公开(公告)日:2020-08-21
申请号:CN201710203054.1
申请日:2017-03-30
Applicant: 国家计算机网络与信息安全管理中心 , 中国科学院声学研究所
IPC: G10L21/0388 , H04S7/00
Abstract: 本发明公开了一种立体声音频的带宽扩展方法与装置。该方法包括:将立体声信号分解为直达声和扩散声;按照预设的频带扩展方法对扩散声进行带宽扩展;将直达声分离成多个不同方位的点声源,对多个点声源分别进行带宽扩展,得到带宽扩展后的多个点声源;将带宽扩展后的多个点声源按照预先估计的方位信息进行重新混合,得到带宽扩展后的直达声;根据带宽扩展后的直达声结合带宽扩展后的扩散声重建出宽带立体声音频信号。借助于本发明的技术方案,解决了现有技术中仅根据单个声道重建信号的主观质量实现对信号带宽的扩展,没有考虑到两个声道中信号能量和相位的相关性,其重建立体声信号严重影响了听者对声源位置和距离的判定的问题。
-
-
-
-
-
-
-
-
-