阅读背景:

PDF 文件中可识别图像的提取

来源:互联网 

PDF(portable document format)文件已经成为全球电子文档分发的开放式标准,是继PostScript文件格式之后的一种新的输出文件格式。PDF 凭借着它的种种优势,克服了电子文件共享过程中经常遇到的识别问题,使用户可以在网上自由地浏览文件和方便地交换文件,它成为进行现代电子文档分发的理想格式。    在 PDF 文件中存在着大量图像。对 PDF 文件中图像的识别除了具有通常图像识别的意义之外,还具有很多因 PDF文件对网络的强大适应性而产生的意义。网络上对 PDF 文件的搜索已经占了很大的比例,如果要按照 PDF 文件中的图像内容进行搜索,就必须要对图像进行识别。而只有把图像信息从 PDF 文件中提取出来,才能进一步用图像识别软件来识别这些图像。可见,对 PDF 文件中的图像进行提取并转化为可供识别的格式,将促进图像识别和信息处理的发展。  PDF(portable document format)文件已经成为全球电子文档分发的开放式




你的当前访问异常,请进行认证后继续阅读剩余内容。

分享到: