检索规则说明:AND代表“并且”;OR代表“或者”;NOT代表“不包含”;(注意必须大写,运算符两边需空一格)
检 索 范 例 :范例一: (K=图书馆学 OR K=情报学) AND A=范并思 范例二:J=计算机应用与软件 AND (U=C++ OR U=Basic) NOT M=Visual
作 者:施海昕 周雪峰 陈凯[2] 刘云锋 SHI Haixin;ZHOU Xuefeng;CHEN Kai;LIU Yunfeng(ICkey(Shanghai)Internet and Technology Co.Ltd.,Shanghai 201612,China;School of Electronic Information and Electrical Engineering,Shanghai Jiao Tong University,Shanghai 201240,China)
机构地区:[1]云汉芯城(上海)互联网科技股份有限公司,上海201612 [2]上海交通大学电子信息与电气工程学院,上海200240
出 处:《微型电脑应用》2020年第11期86-89,共4页Microcomputer Applications
摘 要:传统发票识别通常拿纸质发票扫描再采用OCR识别,识别准确率为80%至90%。而由于本案使用Word或者Excel格式转化成的pdf格式发票,文件保留了完整的字符信息和一些相对固定的格式信息。以编译原理的思维,把发票转化成的文本看作为一种编程语言,再用有限状态机去识别。实验结果表明,准确率可达99%以上,获得了满意的效果。Traditional invoice recognitionis usually completed by scanning paper invoices and then using OCR.The recognition accuracy is about 80%-90%.For our case,the invoice files contain complete character information and some relatively fixed format information.If the text from the invoice is regarded as a programming language,it can be recognized by a finite automaton.Experimental results show that the accuracy of this method can reach more than 99%,which is a satisfactory result.
分 类 号:TP311[自动化与计算机技术—计算机软件与理论]
正在载入数据...
正在载入数据...
正在载入数据...
正在载入数据...
正在载入数据...
正在载入数据...
正在载入数据...
正在链接到云南高校图书馆文献保障联盟下载...
云南高校图书馆联盟文献共享服务平台 版权所有©
您的IP:18.220.96.228