-
公开(公告)号:CN107122416B
公开(公告)日:2021-07-06
申请号:CN201710209305.7
申请日:2017-03-31
Applicant: 北京大学
IPC: G06F16/35 , G06F40/30 , G06F40/295 , G06F40/284 , G06N3/04 , G06N3/08
Abstract: 本发明公开了一种中文事件抽取方法。本方法为:1)对待抽取的中文文本进行实体识别,将识别出来的实体作为事件元素的候选词;对该中文文本逐字进行标注,然后根据标注结果,结合标注模式,识别该中文文本中的事件触发词以及该中文文本所描述的事件类型;2)将该中文文本、事件元素的候选词、事件触发词以及事件类型输入到分类模型中,判断每一所述候选词是否为真实的事件元素;3)根据上述得到的事件元素、事件触发词及事件类型,得到完整的事件结构,完成事件抽取。本发明解决了中文事件抽取中事件触发词和文本中的词语不完全匹配的问题,并提高了中文事件抽取的准确性。
-
公开(公告)号:CN107122416A
公开(公告)日:2017-09-01
申请号:CN201710209305.7
申请日:2017-03-31
Applicant: 北京大学
CPC classification number: G06F17/30699 , G06F17/277 , G06F17/278 , G06F17/2785 , G06F17/30684 , G06F17/30731
Abstract: 本发明公开了一种中文事件抽取方法。本方法为:1)对待抽取的中文文本进行实体识别,将识别出来的实体作为事件元素的候选词;对该中文文本逐字进行标注,然后根据标注结果,结合标注模式,识别该中文文本中的事件触发词以及该中文文本所描述的事件类型;2)将该中文文本、事件元素的候选词、事件触发词以及事件类型输入到分类模型中,判断每一所述候选词是否为真实的事件元素;3)根据上述得到的事件元素、事件触发词及事件类型,得到完整的事件结构,完成事件抽取。本发明解决了中文事件抽取中事件触发词和文本中的词语不完全匹配的问题,并提高了中文事件抽取的准确性。
-