PDF转OFD和PDF文字识别功能优化

iLoveOFD的PDF转OFD和PDF文字识别功能优化

1. PDF转OFD功能

我们定期测试了PDF转OFD功能,发现个别文件存在显示瑕疵。同时调研目前市面上部分ofd阅读器,发现其他阅读器的PDF转OFD也存在瑕疵,少数阅读器显示正常。为了让OFD格式保持显示一致。对pdf转ofd功能进行了优化,解决了个别PDF发票转OFD存在黑点问题。

问题:发票PDF转OFD后,OFD格式存在黑点。

状态:已经解决

示例:原始无黑点的PDF发票转为OFD后存在黑点,优化后,OFD文件显示正常,无黑点。效果如下:

原始PDF转OFD效果:

iLoveOFD

优化后PDF转换OFD效果:

iLoveOFD

2. PDF文字识别(PDFOCR)功能

我们测试发现了PDF文字识别功能,转换后文件体积偏大。通过比较市场上的常见PDFOCR功能,发现PDF文字识别功能转换后的文件体积比其他软件转换后大很多。为了让PDF文字识别功能能正常使用且文件阅读流畅。对PDF文字识别功能进行了优化,解决了文件异常偏大问题。

iLoveOFD

问题:PDF文字识别后的文件体积异常大

状态:已经解决

示例:原始25M的PDF文件,全文无法复制内容,优化前PDF文件转换后的大小2.5GB;优化后,文件变为31M,比其他OCR工具识别后的文件更小。

iLoveOFD

注意:

PDF文字识别主要用于无法复制/搜索型PDF,如果原始PDF已经具备了全文都能复制/搜索内容,建议不要再一次使用PDF文字识别功能哦。

这样会浪费时间的哦~~

如何验证PDF文件已经具备了可复制/搜索

使用浏览器/或者其他PDF浏览器打开文件

  • 使用快捷键Ctrl+F,输入文件中有的文字,如果有反应,则说明本文件支持搜索;
  • 在文件的文字,将鼠标按下不释放,覆盖需要复制的内容后,使用快捷键ctrl+c复制内容,在释放鼠标,然后在其他地方粘贴刚才复制的内容,如果内容存在,则文件可复制,否则不能复制。