2022-12-11 20:30:14
pdf转成word,为什么操作之后,word里面是空白? - 百...
建议别用转换器
给你个方案看看行不行,不用转换器的
利用microsoft office word 2003自己的功能即可实现转换。当然首先安装microsoft office 2003,再打开pdf文件,点击打印,用microsoft office 2003自带的microsoft office document image writer d虚拟打印机,打印需要的页码,然后按”确定“,则立即自动变为另存为(以mdi格式),选好另存的地址,点击”保存“,则立即自动打开保存的mdi格式的文件,再点击mdi格式文件的“工具”中的“使用ocr识别文本”(根据文本的多少可能需要点时间)识别完后再点击“工具”中的”将文本发送到word“,则万事ok。此时,原来pdf上的文本已经转换到word上来了,可以自由复制粘贴了。
从别人那学来的,试一下行不行。
pdf转换成word 但是pdf 里面的数学公式和符号转换不...
offiice2007 有这个功能!
自带了document imaging 安装office的时候选上
默认是不安装的!
还有很多ocr软件
我使用document imaging的时候感觉非常不错! 推荐一下
如果 公式 字母 中文 混排
任何软件都识别不全的!
用ocr就可以了.
比如office 2007中也提供了文字识别服务,结合那个image writer可以很方便将pdf转成word。
第一种方法:用snagit工具进行文字提取。
首先使用snagit的文字捕捉功能将文字提取出来。snagit当前版本为7.02,大小为8903kb,下载地址可以在 找到,汉化补丁可以在 找到。启动snagit,选择菜单“输入/区域”,选择菜单“工具/文字捕获”,然后我们打开要捕捉的文件窗口,按下捕捉快捷键,选定捕捉区域即可捕捉到文字。
接着用相应工具重排文字。此时我们发现提取的文字可能会有很多空格或段落错乱等现象,而且字号、字体等不合自己的心意。这时我们可以用熟悉的wps或word软件进行重新编排。我们以wpsoffice2007为例看看如何对付提取后文章的编排。
用wpsoffice2007打开提取文章;然后选择“工具”菜单下的“文字”/“段落重排”,这时你会看到提取文章重新进行排版;接下来选择“工具”菜单下的“文字”/“删除段首空格”命令,使得文章的每段参差不齐的行首空格被删除;再选择“工具”菜单下的“文字”/“增加段首空格”,文章变为正常的书写格式;提取文章一般都留有空段,为删除这些空段,继续选择“工具”菜单下的“文字”/“删除空段”命令,这时文章完全变为我们所要的形式;用你熟悉的界面任意编辑文章吧。
第二种方法:用屏幕截图然后让ocr软件识别。
打开带有文字的图片或电子书籍,翻到你希望提取的页面,点击键盘上的打印屏幕键(printscreen)进行屏幕捕获;打开windows自带的画图工具,将刚才捕获的屏幕截图,粘贴进去,保存为一个.bmp文件;接着打开刚才保存的文件,在编辑器中进行修正,根据你所要提取的文字进行裁剪,尽量去除不要的部分;最后启动ocr软件,在ocr中打开刚才保存的修改文件,进行文字识别,然后可随心所欲进行编辑。
使用word的替换功能:点击“编辑”》“替换”》“高级”》“特殊字符”,选择“段落标记(.p)”,替换为“ddddd”,,
然后把“段落标记(p)”,替换成空格,把“ddddd”替换成 “.^p^p”
这样省了 80% 的分段