对经历光学字符识别(OCR)过程的文本文档中出现的错误的用户纠正

    公开(公告)号:CN102289667B

    公开(公告)日:2016-01-13

    申请号:CN201110137913.4

    申请日:2011-05-16

    CPC classification number: G06K9/033

    Abstract: 本发明涉及对经历光学字符识别(OCR)过程的文本文档中出现的错误的用户纠正。通过经历OCR过程来创建图像文档的电子模型。电子模型包括图像文档的已经由OCR过程中多个顺序执行的阶段的每一个所确定的元素(例如,单词、文本行、段落、图像)。电子模型充当由处理该图像文档的前一阶段提供给各个阶段的输入信息。向用户呈现图形用户界面,使用户能提供对文档中出现的错误表征的项进行纠正的用户输入数据。基于用户输入数据,产生了引起错误表征的项的初始错误的处理阶段对该初始错误进行纠正。然后,该阶段之后的OCR过程的各阶段对由于初始错误而在它们的相应阶段中产生的随之发生的错误进行纠正。

Patent Agency Ranking