-
公开(公告)号:CN112307718B
公开(公告)日:2021-05-11
申请号:CN202011339681.6
申请日:2020-11-25
Applicant: 北京邮电大学 , 北京欢科科技有限公司
IPC: G06F40/117 , G06F16/84
Abstract: 本发明公开了一种基于文本特征和语法规则的PDF全自动标引系统及方法,系统配置解析层、事件分发层、功能实现层。该系统采用了事件驱动的方式,使用了观察者模式的架构,先通过解析PDF生成一个包含基础信息的XML中间文件,然后再使用文本特征以及语法特征分析等技术分析所有的PDF元素以完成全部自动标引过程;PDF全自动标引方法将整个工作流程分为了七个阶段,分别为元素提取阶段、块聚合阶段、行聚合阶段、图片标签识别阶段、标签匹配阶段、标引文件生成阶段和异常处理阶段,能够实现PDF文件的全自动解析、加标签、聚合并最终导出包含所有信息的结构化数据。本发明提高了系统的扩展性、PDF处理效率和内容利用深度,实现PDF的全自动标引。
-
公开(公告)号:CN112307718A
公开(公告)日:2021-02-02
申请号:CN202011339681.6
申请日:2020-11-25
Applicant: 北京邮电大学 , 北京欢科科技有限公司
IPC: G06F40/117 , G06F16/84
Abstract: 本发明公开了一种基于文本特征和语法规则的PDF全自动标引系统及方法,系统配置解析层、事件分发层、功能实现层。该系统采用了事件驱动的方式,使用了观察者模式的架构,先通过解析PDF生成一个包含基础信息的XML中间文件,然后再使用文本特征以及语法特征分析等技术分析所有的PDF元素以完成全部自动标引过程;PDF全自动标引方法将整个工作流程分为了七个阶段,分别为元素提取阶段、块聚合阶段、行聚合阶段、图片标签识别阶段、标签匹配阶段、标引文件生成阶段和异常处理阶段,能够实现PDF文件的全自动解析、加标签、聚合并最终导出包含所有信息的结构化数据。本发明提高了系统的扩展性、PDF处理效率和内容利用深度,实现PDF的全自动标引。
-
公开(公告)号:CN119006663A
公开(公告)日:2024-11-22
申请号:CN202411061800.4
申请日:2024-08-05
Applicant: 北京邮电大学
IPC: G06T13/20 , G10L19/008 , G06T3/06 , G06T15/20 , G06V40/16 , G06V10/82 , G06N3/045 , G06N3/0464 , G06N3/0499 , G06N3/084
Abstract: 本发明公开了一种基于实时音频驱动的数字人头像生成方法,包括:引入了一个可学习的嵌入代码来实现对3DGS的间接表征完成头像渲染模型训练,根据人脸关键特征和音频编码特征进行损失函数计算完成音频特征提取模型训练,通过实时音频编码特征和人脸关键特征对齐来实现音频对建模动态场景的控制,最终通过Splatting完成说话头的渲染,进而实现语音驱动的说话头生成。本发明引入了一个可训练的嵌入标签作为位置条件,使用动态高斯函数和音频输入驱动说话头进行建模,实现了数字人头像的动态场景渲染,且渲染效率高。
-
-