一种基于多数据源的论文数据爬取方法及系统

    公开(公告)号:CN110704713B

    公开(公告)日:2022-02-08

    申请号:CN201910916820.8

    申请日:2019-09-26

    Abstract: 本发明公开一种基于多数据源的论文数据爬取方法及系统,进行批量关键词论文数据抓取。爬取任务执行前,使用关键词或论文基本信息拼接URL,并将其添加至待抓取队列;执行时,程序分多个子爬取线程,分别从已经经过任务调度算法均衡的多个待爬取队列中取出任务进行源码抓取;执行后,从抓取回的网页源码中解析出所需要的字段,结果存储进数据库中,构建论文数据数据库。相比现有技术,本发明能够提供更高效且全面的论文爬取功能,在服务用户的检索需求时可以快速响应并且将各数据源的查询结果融合展示在用户面前,可以使用户无需对每个数据源的检索结果进行甄别与比对,极大地方便了用户的使用,节约了用户的时间。

    科技领域的综合推荐方法及装置

    公开(公告)号:CN110675083A

    公开(公告)日:2020-01-10

    申请号:CN201910947748.5

    申请日:2019-10-08

    Abstract: 本发明公开了一种科技领域的综合推荐方法,包括:建立科技信息库;采用主观经验法设置多个维度、多个指标、各指标的指标权重、各维度的维度权重;获取每位科研人员的各指标的数据,无量纲化处理,得指标值,计算每位科研人员每个维度的维度总分,并在同一维度下按降序排序,取排名前K1位的科研人员;计算得到每位科研人员的综合得分,按降序排序,排名前K2位的科研人员。本方法具有自由设置维度和指标,精准、全面、方便、快捷的推荐科研人员的有益效果。本发明公开了一种科技领域的综合推荐装置,包括存储模块、数据处理模块、科研人员推荐模块。本发明具有自由设置维度和指标,精准、全面、方便、快捷的推荐科研人员的有益效果。

    一种网站分类方法
    14.
    发明授权

    公开(公告)号:CN103605794B

    公开(公告)日:2017-02-15

    申请号:CN201310651985.X

    申请日:2013-12-05

    Abstract: 本发明公开了一种网站分类方法,包括:获取网站的多维属性,利用集合对多维属性进行表示;针对表示多维属性的集合,进行自编码特征学习;利用自编码学习结果,进行网站聚类学习,得到用于进行网站分类的支持向量机SVM;步骤S104,对任意一个未经标注的网站进行分类时,先进行步骤S101和步骤S102,得到与该网站对应的自编码学习结果;然后将该结构输入到步骤S103得到的SVM中,进行网站分类,得到网站的类别。本发明的网站分类方法能高效准确的按照行业类别对网站进行分类,并且能快速侦测具有恶意特征的钓鱼网页;采用多维属性描述的方式,增加系统的便利性与通用性;且系统具有极强的稳定性。

    一种基于特征注入的仿冒应用程序监测方法

    公开(公告)号:CN103823751B

    公开(公告)日:2016-05-11

    申请号:CN201310682073.9

    申请日:2013-12-13

    Abstract: 本发明是关于一种基于特征注入的仿冒应用程序监测方法,包括以下步骤:步骤S1,获取待监测的应用程序;步骤S2,根据上述应用程序的文件结构,在待监测的应用程序中注入监测特征;步骤S3,对含有监测特征的应用程序进行数字签名;步骤S4,记录待监测应用程序被注入的监测特征与数字签名的配对信息;步骤S5,对被注入监测特征的应用程序进行监测;其中,在监测过程中,当捕获到的应用程序文件中含有被注入的监测特征时,如果该应用程序的数字签名与监测特征对应的签名不一致时,表明该捕获到的应用程序是仿冒应用程序;反之,表明不是仿冒应用程序。借由本发明,能够快速准确地识别仿冒应用程序,实现对仿冒应用程序的实时监测。

    基于海量科研资料的课题立项决策推荐方法及装置

    公开(公告)号:CN115269572A

    公开(公告)日:2022-11-01

    申请号:CN202210836039.1

    申请日:2022-07-15

    Abstract: 本发明公开了一种基于海量科研资料的课题立项决策推荐方法及装置,所述方法包括:收集科研资料样本,并根据课题样本的课题属性进行属性特征的抽取;基于所述课题属性的数量,对所述BP神经网络的神经元初始权值与阈值进行初始实数编码,得到若干个基因染色体;将所述属性特征输入BP神经网络进行训练,并以期望数据样本与预测数据样本相应的误差函数作为个体适应度函数,进行遗传算法计算,得到最佳个体基因染色体;基于所述到最佳个体基因染色体,初始化所述BP神经网络;利用所述属性特征对遗传算法改进后的BP神经网络进行训练,得到决策推荐模型;基于所述决策推荐模型,获取目标课题的推荐结果。本发明可以支撑和辅助科研立项决策工作。

Patent Agency Ranking