-
公开(公告)号:CN119990374A
公开(公告)日:2025-05-13
申请号:CN202510072358.3
申请日:2025-01-16
Applicant: 支付宝(杭州)信息技术有限公司
Abstract: 本说明书一个或多个实施例提供了一种混合专家模型的数据路由方法及装置,其获取混合专家模型对于待路由数据的原始路由矩阵;该原始路由矩阵中各个元素为混合专家模型中各个专家子模型对于待路由数据的原始路由参数;在当前训练步数不大于预设步数的情况下,也即在模型训练初期,不再直接根据原始路由矩阵对待路由数据进行路由,而是先根据原始路由矩阵确定对应的随机路由矩阵;该随机路由矩阵中各个元素为与各个所述原始路由参数对应的随机路由参数;然后根据该随机路由矩阵对待路由数据进行路由,以确定将待路由数据输入哪一个或几个专家子模型。