2023-01-12 14:01:36
求助,我的pdf格式的文件无法识别成word怎么办? - 百...
情况二:如果你所得到的pdf文档是用扫描仪扫进去的图片转换的,那么就麻烦了,不过还是比手输入快多了,所以继续往下看。首先你用acrobat把pdf文件打开,然后点文件――另存为――把他保存成图片格式*.tiff(这是无压缩图片格式,以便识别),然后到网上下载文字识别软件,建议用尚书六号(现在好像出到七号了,很有名,随处都可以下到),安装好后,打开转换好的tiff图片,点击识别,看,文字出来了吧,尚书系列文字识别软件功能十分强大,你可以在里面把文字都编辑好了,再保存成rtf或txt文件,然后粘贴到word里就可以使用了,注意过滤回车符。
pdf转word怎么转出来还是图片啊,还有提示“可能无法...
分两种情况:一种情况是原来作者转为pdf的时候就是图片直接转过来的,那你用pdf转word的软件直接转word转过来的肯定还是图片格式。如果是这种情况你转word前需要先用ocr识别软件进行识别,把图片中的文字识别出来,这样再转word就可以了,你可以试试汉王的ocr识别软件或者其他供应商的。
另一种情况就是你用的软件不行,换一个转换软件试试。
为什么pdf文件转换word打开是乱码
网络上面有一些pdf资料你可以对其内容复制,但是粘贴到word或者文本中就是一堆乱码,你用转换软件转换出来,有一些文件不会是乱码,但是还有一些文件依旧是乱码,怎么办呢?我们现在就讲怎么处理pdf转word成乱码的问题。
工具/原料
adobe reader / adobe acrobat pro 软件
solid converter pdf 6 / 7 软件
abbyy finereader 9 /10 软件
步骤/方法
首先我们要明白这个转换出乱码是怎么回事?
我们先用adobe reader 或者adobe acrobat pro软件打开我们会出现乱码的pdf文件,
然后,菜单栏,文件--------属性--------字体项 我们可以看到是不是文件内嵌了很多字体。
我们这里找了一个文件为例:
的时候是先读取内嵌的字体,如果内嵌的字体没有,那么再读取你系统中的字体来显示,然而word
文件是直接读取系统中的字体的,那么如果你pdf文件中内嵌的某个或者某些字体在你的操作系统中
没有,那么转换出来的word文件一般都会出现乱码。
图中本文档中使用的字体就是文件内嵌的字体,由于pdf文件是可以内嵌字体的,所以你打开pdf文件
pdf转word乱码怎么办
知道了转换后为什么会出现乱码以后, 现在我们找一个转换软件来测试转换结果,这里我们用anybizsoft pdf converter 2.5 测试。
转换完毕后我们打开得到的word文件看看会不会是乱码?
我截取了其中一个典型的页面,大家可以看看和pdf原文的对比,转换成word后是一堆乱码。
pdf转word乱码怎么办
pdf转word乱码怎么办
接下来我们换一个转换软件,我们使用solid converter pdf 6 / 7 软件。
这款转换软件是灰常强大的一个pdf转换软件,转换效果很好,而且版面也保持的很好。而且在以前
转换的使用过程中发现这个软件可以自动替换一部分pdf内嵌的字体,从而达到解决一些转换文件的
乱码问题,但是这个软件不是能够解决所有的乱码问题,有时候转换出来的还会是乱码。
比较惊喜的发现,用这个软件转换出来的虽然没有原文那样整齐,但是确实已经不是乱码了。
如果你用这个软件处理出来不是乱码了,那么我们的目的就达到了,如果用这个软件转换出来还是乱码
那么我们接着往下看。
pdf转word乱码怎么办
如果solid converter pdf 搞不定的话, 那么我们就只能用abbyy finereader 这个软件对这个pdf进行ocr识别处理了。
软件界面的设置如下图:
转换的过程:
如果中间出现错误什么的,会有提示的。
转换完毕后我们打开转换好的word,截图,大家看效果:
效果还是相当不错的~~~ 乱码解决了~~~ 效果甚至比solid converter pdf还好。
pdf转word为什么总失败
和大小没关系,如果加密了要先解除密码在转换,下面是步骤:1. 如果不是图片类做成的pdf 你可以尝试用verypdf pdf2word 工具或者使用solid converter pdf 转换 但是如果是内嵌了字体的,那么就要看情况了,因为有的字体你系统里面有,转出来就没有问题,如果系统里面没有,那么转出来就是一堆乱码,那么就先要把这些pdf文件转成位图形式(也就是常说的pdf转曲)然后再用工具转,当然这时候上面的2个工具基本无能为力了
2.对于是图片做成的pdf 那么我们就需要用ocr类软件进行识别了,你可以用比较简单的cajviewer来提取 但是只能是一页页提取文字,或者你可以使用readiris corporate 12软件来进行识别,但是readiris corporate 12呢需要下载支持韩语 日语还有简体中文的亚洲语言包才是识别中文,但是这个软件的ocr识别率是比较好的~~~~当然还有abbyy finereader 也是一款识别率很高的软件,关键还支持中文识别~~也是一款不可多得的ocr软件,这里我强力推荐这个软件。
3. 对于一些不允许做修改的pdf文件(就是加密加了权限的pdf),那么就先要去除密码或者去除数字证书,才能照上面两个步骤做。