-
公开(公告)号:CN114936723B
公开(公告)日:2023-04-14
申请号:CN202210856300.4
申请日:2022-07-21
Applicant: 中国电子科技集团公司第三十研究所 , 国家计算机网络与信息安全管理中心
Abstract: 本发明涉及数据挖掘技术领域,公开了一种基于数据增强的社交网络用户属性预测方法及系统,该属性预测方法,基于用户的历史行为序列,推断用户未来一段时间的行为序列,通过将历史行为序列与预测得到的行为序列进行拼接,扩大行为序列的长度,对用户的行为数据进行增强。本发明解决了现有技术存在的在线网络用户行为序列长度较短时不能为用户属性预测任务提供足够信息、从而导致用户属性预测的预测准确性低的问题。
-
公开(公告)号:CN115001861A
公开(公告)日:2022-09-02
申请号:CN202210852995.9
申请日:2022-07-20
Applicant: 中国电子科技集团公司第三十研究所 , 国家计算机网络与信息安全管理中心
IPC: H04L9/40
Abstract: 本发明涉及计算机网络技术领域,公开了一种基于混合指纹特征的暗网服务异常检测方法及系统,该异常检测方法,对暗网站点的流量数据和状态数据进行分析,通过分析状态数据和流量数据,提取暗网站点的单点指纹特征、话题关联的指纹特征、流量指纹信息,进行暗网服务异常检测。本发明解决了解决现有技术存在的难以对暗网站点的重要度进行整体地准确检测等问题。
-
公开(公告)号:CN114915599A
公开(公告)日:2022-08-16
申请号:CN202210845605.5
申请日:2022-07-19
Applicant: 中国电子科技集团公司第三十研究所 , 国家计算机网络与信息安全管理中心
IPC: H04L47/2483 , H04L47/2441 , G06N3/04 , G06N3/08 , G06K9/62
Abstract: 本发明涉及计算机网络技术领域,公开了一种基于半监督聚类学习的暗网站点会话识别方法及系统,该会话识别方法,利用深度学习CNN算法自动提取Obfs4网桥下暗网站点会话的特征,并利半监督聚类算法对暗网站点的onion地址进行识别。本发明解决了现有技术存在的泛化性不足、识别准确度较低、实用性不足等问题。
-
公开(公告)号:CN115001861B
公开(公告)日:2022-12-09
申请号:CN202210852995.9
申请日:2022-07-20
Applicant: 中国电子科技集团公司第三十研究所 , 国家计算机网络与信息安全管理中心
IPC: H04L9/40
Abstract: 本发明涉及计算机网络技术领域,公开了一种基于混合指纹特征的暗网服务异常检测方法及系统,该异常检测方法,对暗网站点的流量数据和状态数据进行分析,通过分析状态数据和流量数据,提取暗网站点的单点指纹特征、话题关联的指纹特征、流量指纹信息,进行暗网服务异常检测。本发明解决了解决现有技术存在的难以对暗网站点的重要度进行整体地准确检测等问题。
-
公开(公告)号:CN115081437B
公开(公告)日:2022-12-09
申请号:CN202210855918.9
申请日:2022-07-20
Applicant: 中国电子科技集团公司第三十研究所 , 国家计算机网络与信息安全管理中心
IPC: G06F40/279 , G06F40/253 , G06F40/242 , G06F40/216 , G06F40/211 , G06F40/30 , G06F16/33
Abstract: 本发明涉及文本检测技术领域,公开了基于语言学特征对比学习的机器生成文本检测方法及系统,该机器生成文本检测方法,包括以下步骤:S1,预训练模型调整;S2,话语图构建;S3,向量表示计算;S4,文本检测参数更新。本发明解决了现有技术存在的在标注数据有限的情况下自动准确识别网络中的机器生成文本等问题。
-
公开(公告)号:CN114915599B
公开(公告)日:2022-11-11
申请号:CN202210845605.5
申请日:2022-07-19
Applicant: 中国电子科技集团公司第三十研究所 , 国家计算机网络与信息安全管理中心
IPC: H04L47/2483 , H04L47/2441 , G06N3/04 , G06N3/08 , G06K9/62
Abstract: 本发明涉及计算机网络技术领域,公开了一种基于半监督聚类学习的暗网站点会话识别方法及系统,该会话识别方法,利用深度学习CNN算法自动提取Obfs4网桥下暗网站点会话的特征,并利半监督聚类算法对暗网站点的onion地址进行识别。本发明解决了现有技术存在的泛化性不足、识别准确度较低、实用性不足等问题。
-
公开(公告)号:CN114936723A
公开(公告)日:2022-08-23
申请号:CN202210856300.4
申请日:2022-07-21
Applicant: 中国电子科技集团公司第三十研究所 , 国家计算机网络与信息安全管理中心
Abstract: 本发明涉及数据挖掘技术领域,公开了一种基于数据增强的社交网络用户属性预测方法及系统,该属性预测方法,基于用户的历史行为序列,推断用户未来一段时间的行为序列,通过将历史行为序列与预测得到的行为序列进行拼接,扩大行为序列的长度,对用户的行为数据进行增强。本发明解决了现有技术存在的线网络用户行为序列长度较短时不能为用户属性预测任务提供足够信息、从而导致用户属性预测的预测准确性低的问题。
-
公开(公告)号:CN115081437A
公开(公告)日:2022-09-20
申请号:CN202210855918.9
申请日:2022-07-20
Applicant: 中国电子科技集团公司第三十研究所 , 国家计算机网络与信息安全管理中心
IPC: G06F40/279 , G06F40/253 , G06F40/242 , G06F40/216 , G06F40/211 , G06F40/30 , G06F16/33
Abstract: 本发明涉及文本检测技术领域,公开了基于语言学特征对比学习的机器生成文本检测方法及系统,该机器生成文本检测方法,包括以下步骤:S1,预训练模型调整;S2,话语图构建;S3,向量表示计算;S4,文本检测参数更新。本发明解决了现有技术存在的在标注数据有限的情况下自动准确识别网络中的机器生成文本等问题。
-
公开(公告)号:CN115002045A
公开(公告)日:2022-09-02
申请号:CN202210845956.6
申请日:2022-07-19
Applicant: 中国电子科技集团公司第三十研究所
IPC: H04L47/2483 , G06N3/04
Abstract: 本发明涉及计算机网络技术领域,公开了一种基于孪生网络的暗网站点会话识别方法及系统,该识别方法,基于Meek网桥捕获的暗网会话,构建孪生神经网络模型对暗网站点进行识别。本发明解决了现有技术存在的难以深度表征Meek流量下暗网站点会话的特征、模型泛化性不足、难以保障识别暗网站点会话的准确性等问题。
-
公开(公告)号:CN114090796B
公开(公告)日:2024-08-27
申请号:CN202111367064.1
申请日:2021-11-18
Applicant: 中国电子科技集团公司第三十研究所
IPC: G06F16/38 , G06F16/35 , G06F16/36 , G06F40/284
Abstract: 本发明提供一种多平台文本二级标签体系搭建及完善迭代的方法,包括:S10,迭代扩充一级标签下的代表词;S20,基于代表词确定初始二级标签;S30,基于初始二级标签完成二级标签扩充与融合。本发明的有益效果是:1、本发明通过代表词语料获取,词向量模型训练,相似词提取的方式扩充代表词数量,极大地减少了人工收集的过程,并且也较大的降低了人工筛选的难度。2、本发明利用代表词聚类的方式自动化生成各代表词的标签类别,对于人工归纳二级标签提供了便利型。3、本发明使用测试文本进行二级标签的进一步扩充融合的方法除了提高了二级标签的覆盖率,对于新文本二级标签的归类和新建也提供了帮助。
-
-
-
-
-
-
-
-
-