-
公开(公告)号:CN111325113A
公开(公告)日:2020-06-23
申请号:CN202010078402.9
申请日:2020-02-03
Applicant: 支付宝(杭州)信息技术有限公司
Abstract: 本说明书实施例提供一种图像检测方法、装置、设备及介质。在一个实施例中,该方法可以包括:首先,获取目标图像;接着,在确定目标图像包括可交换图像文件信息的情况下,判断可交换图像文件信息是否包括目标信息,得到第一判断结果;然后,在第一判断结果为是的情况下,判断目标信息是否满足预设条件,得到第二判断结果;再接着,在第二判断结果为是的情况下,确定目标图像被篡改。
-
公开(公告)号:CN114880517B
公开(公告)日:2024-10-22
申请号:CN202210592045.7
申请日:2022-05-27
Applicant: 支付宝(杭州)信息技术有限公司
IPC: G06F16/73 , G06F16/783 , G06F16/75
Abstract: 本说明书实施例提供了用于视频检索的方法及装置。在该方法中,获取待匹配视频中的视频帧图像;从视频帧图像中提取图像特征以及文本特征;根据用于表征聚类中心的中心变量对图像特征和所述文本特征进行特征融合,以得到融合特征,其中,中心变量用于将属于同一视频的不同模态的特征进行关联;以及根据融合特征在视频数据库中进行视频检索,以确定出视频数据库中与待匹配视频相匹配的视频,其中,视频数据库中存储有多个视频以及每个视频对应的视频特征。
-
公开(公告)号:CN112926700B
公开(公告)日:2022-04-12
申请号:CN202110460794.X
申请日:2021-04-27
Applicant: 支付宝(杭州)信息技术有限公司
Abstract: 本说明书实施例提供一种针对目标图像的类别识别方法和装置,所述目标图像中包括文本,所述方法包括:识别所述目标图像中的文本内容,得到第一文本识别结果;将所述目标图像输入图像编码器,通过所述图像编码器输出所述目标图像对应的第一图像语义特征向量;将所述第一文本识别结果输入文本编码器,通过所述文本编码器输出所述第一文本识别结果对应的第一文本语义特征向量;将所述第一图像语义特征向量和所述第一文本语义特征向量输入多模融合编码器,通过所述多模融合编码器输出第一全局特征向量;根据所述第一全局特征向量,确定所述目标图像的目标类别。能够提高针对目标图像的类别识别的准确率。
-
公开(公告)号:CN113688650A
公开(公告)日:2021-11-23
申请号:CN202111117739.7
申请日:2021-09-22
Applicant: 支付宝(杭州)信息技术有限公司 , 蚂蚁区块链科技(上海)有限公司
Inventor: 黄莹 , 黄星 , 廖群伟 , 陈景东 , 王剑 , 刘家佳 , 暨凯祥 , 胡锦华 , 刘雷 , 武琳娟 , 王昊 , 章鹏 , 李莎 , 卢睿 , 杜金泉 , 冯成林 , 张谦 , 苏煜 , 林楠 , 鞠春春 , 吕炯炯 , 朱伟
Abstract: 本公开披露了一种识别图片的方法和装置。所述方法包括:接收扫码图片,所述扫码图片包含商品的营销活动对应的活动码;对所述扫码图片进行图像识别,以确定所述扫码图片是否为目标图片,所述目标图片为对所述商品的实体上的所述活动码进行扫描后得到的图片。
-
公开(公告)号:CN113076433A
公开(公告)日:2021-07-06
申请号:CN202110454387.8
申请日:2021-04-26
Applicant: 支付宝(杭州)信息技术有限公司
IPC: G06F16/38 , G06F16/33 , G06F16/583 , G06N3/04 , G06N3/08
Abstract: 本说明书实施例提供一种具有多模态信息的检索对象的检索方法和装置,方法包括:获取单模态的查询信息,单模态的查询信息为第一文本或第一图片;当查询信息为第一文本时,将第一文本输入生成模型,生成与第一文本包含的主体对应的图像特征;将第一文本对应的文本特征和图像特征输入图文转换器,对文本特征和图像特征进行基于自注意力的融合,输出查询信息的第一查询特征向量;根据第一查询特征向量与各检索特征向量之间的相似度,确定与查询信息相匹配的检索对象;各检索特征向量分别对应于数据库中的各检索对象,任一检索特征向量为将其对应的检索对象的多模态信息输入图文转换器得到的。能够提高检索精度。
-
公开(公告)号:CN112926700A
公开(公告)日:2021-06-08
申请号:CN202110460794.X
申请日:2021-04-27
Applicant: 支付宝(杭州)信息技术有限公司
Abstract: 本说明书实施例提供一种针对目标图像的类别识别方法和装置,所述目标图像中包括文本,所述方法包括:识别所述目标图像中的文本内容,得到第一文本识别结果;将所述目标图像输入图像编码器,通过所述图像编码器输出所述目标图像对应的第一图像语义特征向量;将所述第一文本识别结果输入文本编码器,通过所述文本编码器输出所述第一文本识别结果对应的第一文本语义特征向量;将所述第一图像语义特征向量和所述第一文本语义特征向量输入多模融合编码器,通过所述多模融合编码器输出第一全局特征向量;根据所述第一全局特征向量,确定所述目标图像的目标类别。能够提高针对目标图像的类别识别的准确率。
-
公开(公告)号:CN112633185A
公开(公告)日:2021-04-09
申请号:CN202011565601.9
申请日:2020-09-04
Applicant: 支付宝(杭州)信息技术有限公司
Abstract: 本说明书实施例提供一种图像处理的方法和装置,将光谱遥感图像切割为多个待处理图像进行处理,尽可能保留光谱遥感图像的信息。在处理光谱遥感图像时,按照不同的分辨率,对光谱遥感图像在多个尺度(对应分辨率)上进行缩放,从而得到各个尺度分别的语义分割结果,以及相应的注意力图。进一步地,利用注意力图,对各个语义分割结果进行融合。该方法引入注意力图,来描述语义分割的重要度,从而提高目标识别结果的准确度。
-
公开(公告)号:CN111931873B
公开(公告)日:2020-12-22
申请号:CN202011040050.4
申请日:2020-09-28
Applicant: 支付宝(杭州)信息技术有限公司
Abstract: 本说明书实施例提供了图像识别方法和装置。根据实施例的方法,首先需要对待识别图像分别进行两次降尺寸处理,其中一个分支得到保留有待识别图像的全局语义及上下文关系的全局特征,另一个分支得到损失了待识别图像的全局语义但是保留有局部细节的多个第一局部特征。然后利用两个分支协同工作,在特征层面进行了特征共享,使得两个分支能够共享信息,同时关注各自擅长的部分,有效地利用待识别图像的整体和局部信息完成对待识别图像的识别。
-
公开(公告)号:CN111898613A
公开(公告)日:2020-11-06
申请号:CN202011054144.7
申请日:2020-09-30
Applicant: 支付宝(杭州)信息技术有限公司
Abstract: 本说明书实施例提供了半监督语义分割模型训练方法、识别方法和装置,根据实施例的半监督语义分割模型训练方法,首先通过获取人工对第一图像中的待标注对象进行标注后得到的第一监督数据,进而通过第一监督数据训练得到对待标注对象的识别率相对较高的全监督语义分割模型。利用全监督语义分割模型对未经过人工标注的第二图像中的待标注对象进行标注,得到第二监督数据。再利用经过人工标注得到的第一监督数据和经过全监督语义分割模型标注得到的第二监督数据训练半监督语义分割模型,并利用半监督语义分割模型对第一图像、第二图像和随机扰动项进行识别,得到第三监督数据。最后通过第一、第二和第三监督数据对半监督语义分割模型再次训练。
-
公开(公告)号:CN119007861A
公开(公告)日:2024-11-22
申请号:CN202410918028.7
申请日:2024-07-09
Applicant: 支付宝(杭州)信息技术有限公司
Abstract: 本说明书一个或多个实施例提供一种气体浓度预测模型训练方法及装置。其中,该方法包括:获取携带有目标气体的浓度标签的样本集;所述样本集包含多条样本数据,每条样本数据用于记录至少一种与目标气体的浓度存在关联关系的协变量;将所述样本集包含的样本数据输入待训练的气体浓度预测模型;其中,所述气体浓度预测模型包括注意力模块和预测模块,所述注意力模块用于从输入的样本数据中提取注意力信息,该注意力信息被用于与所述样本集包含的样本数据进行拼接,且得到的拼接数据进一步被输入所述预测模块,以由所述预测模块输出所述目标气体的预测浓度;根据所述预测浓度与所述浓度标签的差异,对所述气体浓度预测模型进行迭代训练。
-
-
-
-
-
-
-
-
-