一种基于均衡求解的大模型对齐方法

    公开(公告)号:CN119539058A

    公开(公告)日:2025-02-28

    申请号:CN202411689955.2

    申请日:2024-11-25

    Abstract: 本发明提供一种基于均衡求解的大模型对齐方法,涉及数据处理技术领域,该方法包括:获取问题数据集和预测模型,所述问题数据集包括多个问题,所述预测模型用于在不同场景下判断回应的回应效果;基于预设语言模型对所述多个问题中每个问题进行回应,得到所述每个问题对应的两个回应文本;基于所述预测模型将所述每个问题对应的两个回应文本划分为第一文本和第二文本,所述第一文本的回应效果好于所述第二文本的回应效果;基于所述每个问题对应的第一文本和第二文本构建训练数据集;基于所述训练数据集对所述预设语言模型进行训练,得到目标模型,所述目标模型用于对问题进行回应。本发明能提高语言模型输出的回应效果。

Patent Agency Ranking