2023-01-04 03:49:20
pdf转换成word里的图都是乱码怎么回事?
原因:
pdf转word的时候是先读取内嵌的字体,如果内嵌的字体没有,那么再读取你系统中的字体来显示,然而word文件是直接读取系统中的字体的,那么如果你pdf文件中内嵌的某个或者某些字体在你的操作系统中没有,那么转换出来的word文件一般都会出现乱码。
处理办法:
-
绝大多数转化软件都有局限性,再加上本身文档的特点,一般不能完全解决乱码、错字、格局紊乱等现象。选择尽可能识别度高的软件如abbyy finereader。
-
转化识别存在着一定的错误率,这个和被识别文件的清晰度,分辨率有关系,文件分辨率高,清晰度好,准确率就高,反之,准确率就低。因此无论选择那一款转化工具,最终一定要仔细核对文档。
pdf转换成为word内容出现乱码怎么办
首先我们要明白这个转换出乱码是怎么回事?
我们先用adobe reader 或者adobe acrobat pro软件打开我们会出现乱码的pdf文件,
然后,菜单栏,文件--------属性--------字体项 我们可以看到是不是文件内嵌了很多字体。
我们这里找了一个文件为例:
的时候是先读取内嵌的字体,如果内嵌的字体没有,那么再读取你系统中的字体来显示,然而word
文件是直接读取系统中的字体的,那么如果你pdf文件中内嵌的某个或者某些字体在你的操作系统中
没有,那么转换出来的word文件一般都会出现乱码。
2
图中本文档中使用的字体就是文件内嵌的字体,由于pdf文件是可以内嵌字体的,所以你打开pdf文件
3
知道了转换后为什么会出现乱码以后, 现在我们找一个转换软件来测试转换结果,这里我们用anybizsoft pdf converter 2.5 测试。
转换完毕后我们打开得到的word文件看看会不会是乱码?
我截取了其中一个典型的页面,大家可以看看和pdf原文的对比,转换成word后是一堆乱码。
4
5
6
接下来我们换一个转换软件,我们使用solid converter pdf 6 / 7 软件。
这款转换软件是灰常强大的一个pdf转换软件,转换效果很好,而且版面也保持的很好。而且在以前
转换的使用过程中发现这个软件可以自动替换一部分pdf内嵌的字体,从而达到解决一些转换文件的
乱码问题,但是这个软件不是能够解决所有的乱码问题,有时候转换出来的还会是乱码。
比较惊喜的发现,用这个软件转换出来的虽然没有原文那样整齐,但是确实已经不是乱码了。
如果你用这个软件处理出来不是乱码了,那么我们的目的就达到了,如果用这个软件转换出来还是乱码
那么我们接着往下看。
7
8
如果solid converter pdf 搞不定的话, 那么我们就只能用abbyy finereader 这个软件对这个pdf进行ocr识别处理了。
软件界面的设置如下图:
转换的过程:
如果中间出现错误什么的,会有提示的。
转换完毕后我们打开转换好的word,
pdf文件转换成word文件后都是乱码怎么办啊
本答案仅供参考:
1.
汉王pdf_converter能很快而且准确地将pdf文件转换成用word打开的rtf文件,并且是免费版的
下载网址
http://xiazai.zol.com.cn/detail/33/326858.shtml
如果全是扫描图片或乱码,则用雪莹docconvert虚拟打印机输出为jpg格式,再用汉王文豪7600进行识别