2022-12-14 22:04:13
如果
pdf是图片转化来的,就不会识别的。你还不如直接把pdf保存成jpg图片,然后用ocr软件直接识别。再一个如果pdf底纹太重的话,也识别不了的。
pdf有一种是word文本直接转成pdf的,这种方法的pdf再软化成word就非常方便。还有一种pdf是photoshop之类的图像软件制作的,这种方式制作的pdf只能再转换成图片,然后再用ocr识别。
方正ocr是一个比较好用的,我的印刷厂经常会排人家拿现成的书,我就让打字员用扫描仪扫描,保存成jpg格式的图片,然后就用方正ocr识别。
另外office 2003及以后的所有版本,只要是安装企业完全版,并且在安装时选择自定义,就都有图像识别成word文档的功能。这个功能在开始-程序-office -office 工具中。
pdf转换成word后乱七八糟的,都串行了,看不懂 - 百度...
这个是有可能发生的,其它文档转成pdf后能基本保持原来视觉效果(格式并不一定一样,因为不同文档采用的是不同的原来),如果你的pdf文档不是word生成的,那么转成word后格式是有可能差别很大的。
为什么pdf文件转换成word文件之后,怎么字上都有个文...
这个是正常的,加密的低版本、图表什么的都会导致这种问题。直接转成word图片会完整的保存,但文本可能就很乱。所以建议你保存一份带辅助工具的文本,再转成一份word,
如果你也可以给我,发我163邮箱,我帮你试试 。aoelfhong@
pdf文件转换成word后乱码或不能编辑的问题
利用microsoft office word 2003自己的功能即可实现转换。
首先电脑系统要安装microsoft office 2003;
其次,打开你所要转换的pdf文件,点击打印;
( 用microsoft office 2003自带microsoft office document image writer d虚拟打印机,打印需要的页码 ) [这一般是默认的,直接按确定就可!]
然后按“确定”,则立即自动变为另存为(以mdi格式),选好另存的目录,点击“保存”,则立即自动打开保存的mdi格式的文件;
再点击mdi格式文件的“工具”中的“使用ocr识别文本”(根据文本的多少可能需要点时间)识别完后;
再点击“工具”中的“将文本发送到word”,则一切搞定!
此时,原来pdf上的文本已经转换到word上来了,可以自由复制粘贴了。
当然,这是对于那些pdf无法复制的文件,毕竟这样转换过来的文件与原来的还是有点出路,
最好是再对照哦。