永发信息网

大侠们,请问win7怎么把CAJ和PDF转化为DOC ???谢谢!!!

答案:2  悬赏:50  手机版
解决时间 2021-01-28 09:48
大侠们,请问win7怎么把CAJ和PDF转化为DOC ???谢谢!!!
最佳答案
如今网上许多资料都是以CAJ、PDF等文件格式提供的,其中的文本不可以被直接编辑。网上提供了许多处理这种情况的软件,但是它们不是效率低,就是只可以提取其中部分文本。本文所述利用微软提供的OCR识别技术从CAJ、PDF等文件中提取全部文本的办法,简便快捷,效率很高。
从不同格式的文件中提取文本前需要做好以下准备工作,安装CAJViewer5.5浏览器软件和acrobat 5 专业版浏览器软件安装Office2003,并完全安装Of?鄄fice工具Microsoft Office Document Imaging,然后在打印机里面会增加Microsoft Office Document Image Writer打印机。 Microsoft Office Document Image可以非常准确的全文件识别转化中文、英文、表格。

一、CAJ文件的识别

(一)首先,从网上下载CAJ格式的资料文件保存到本地硬盘上。

(二)然后,启动CAJViewer浏览器程序,并在该程序中打开刚才保存的CAJ格式的文件。浏览文件到最后一页后,不要关闭CAJ浏览器程序。

(三)在CAJ浏览器程序窗口中,选择“文件”→“打印”,并选择打印机为Microsoft Office Document Image Writer打印机,勾选打印到文件选项和确定打印页数。

(四)保存打印文件(*.prn)到适当位置。等待打印完成后,Microsoft Office Document Image 主动打开刚才保存的打印文件。

(五)在Microsoft Office Document Image窗口中,选择“页面”菜单中的“选择所有页面”菜单项,然后选择“工具”菜单中的“应用OCR识别文本”提取文本。

(六)选择“工具”下的 “将文本发送到word”,最后将把整个CAJ文件识别输出到word文件中。

二、PDF文件的识别

(一)以文本形式保存的PDF文件,用acrobat 5 专业版,识别整个文件。直接打开从网上下载的PDF格式文件另存为RTF文件,或者选择工具栏上的文字选择按钮,然后选择文字区域,然后复制到Word中即可。

(二)以图片形式保存的PDF文件,将PDF文件打印到Microsoft Office Document Image Writer打印机,选择打印形成的文件的保存位置,然后会主动形成一个MDI文件,并且主动用Microsoft Office Document Image打开此文件,然后在Microsoft Office Document Im?鄄age中选择“工具”菜单中的“应用OCR识别文本”,识别完成后,在选择“工具”下的,“将文本发送到word”,最后将把整个PDF文件识别输出到word文件中。

(三)加密的PDF文件先下载解密软件,解密后在参照上述步骤1),2) 进行。

(四)繁体PDF文件用上述步骤2)的办法识别到word后,用word中的“工具”→“语言”→“中文繁简转换”

三、超星文件的识别

(一)全文件识别打印到Microsoft Office Document Image Writer打印机,然后按上述PDF文件的识别步骤中第二点操作,要注意的是,超星打印功可以有点区别,因为超星是目录和全文分开的,所以打印时,需要分别把目录和正文识别到Word中,再合并到一起。打印时要填入打印页码从1到最后一页,不要选择打印全部。在打印选项中,要将页面比例设成真正大小,而不是整宽。注意识别速度比其他格式要慢很多,请保持耐心。通常一本200多页的书,识别需要几分钟的时间。

(二)超星文件识别相对比较麻烦一些,假如还有疑问,可以先把超星打印成完整的PDF文件,然后再用上述识别PDF文件的办法转成Word。 四、后记 经过试验,发现Microsoft Office Document Image 存在一些不稳定的疑问,如在用CAJ打印到Microsoft Office Document Image Writer时,发现用CAJ5.5版本比较快,而CAJ5.0有时出现假死机。页面显示大时,转化的识别率较高。假如页数多的文件,包括超星,可以分多次转化。 由于虚拟打印到Microsoft Office Document Image Writer 比较慢,并且形成的虚拟文件很大,1本200多页的书大约是60M,因此会严重影响机器的运行速度、C盘和内存空间。建议配置好的机器一次转化不要超过200页,配置差的不要超过100页,同时打印时在任务栏中会出现打印机图标,可以双击,看到打印任务的进度,避免误以为死机。转化完成后请删除c:\windows\temp目录下的虚拟打印文件,否则C盘很快会被用光。
全部回答
CAJ格式转换成WORD的方法 现在网上许多资料都是以CAJ、PDF等文件格式提供的,其中的文本不能被直接编辑。网上提供了许多处理这种情况的软件,但是它们不是效率低,就是只能提取其中部分文本。本文所述利用微软提供的OCR识别技术从CAJ、PDF等文件中提取全部文本的方法,简便快捷,效率很高。 从不同格式的文件中提取文本前需要做好以下准备工作,安装CAJViewer5.5浏览器软件和acrobat 5 专业版浏览器软件安装Office2003,并完全安装Of?鄄fice工具Microsoft Office Document Imaging,然后在打印机里面会增加Microsoft Office Document Image Writer打印机。 Microsoft Office Document Image可以非常准确的全文件识别转化中文、英文、表格。 一、CAJ文件的识别 (一)首先,从网上下载CAJ格式的资料文件保存到本地硬盘上。 (二)然后,启动CAJViewer浏览器程序,并在该程序中打开刚才保存的CAJ格式的文件。浏览文件到最后一页后,不要关闭CAJ浏览器程序。 (三)在CAJ浏览器程序窗口中,选择“文件”→“打印”,并选择打印机为Microsoft Office Document Image Writer打印机,勾选打印到文件选项和确定打印页数。 (四)保存打印文件(*.prn)到适当位置。等待打印完成后,Microsoft Office Document Image 自动打开刚才保存的打印文件。 (五)在Microsoft Office Document Image窗口中,选择“页面”菜单中的“选择所有页面”菜单项,然后选择“工具”菜单中的“使用OCR识别文本”提取文本。 (六)选择“工具”下的 “将文本发送到word”,最后将把整个CAJ文件识别输出到word文件中。 二、PDF文件的识别 (一)以文本形式保存的PDF文件,用acrobat 5 专业版,识别整个文件。
我要举报
如以上问答信息为低俗、色情、不良、暴力、侵权、涉及违法等信息,可以点下面链接进行举报!
大家都在看
烦请告知华梵师父在14日杭州佛教图书馆的讲座
分手后,男人为什么生怕女人看不见他,还故意
佛山市跆拳道协会智信跆拳道总馆地址有知道的
小学生早恋的危害
【夜光的的星星我想自己整个夜光的星星,夜光
老赌经-A真的准吗?
勾追的意思是什么啊?知道的请说下!
补邮费专用链接 是干什么的
黄飞鸿狮艺武术训练基地地址好找么,我有些事
为什么在我的豆瓣里我可以看到我的文章,别人
如图所示,当金属棒a在金属轨道上运动时,线
远驾的意思是什么啊?知道的请说下!
2015款大众途观前保险杠多少钱
广州体育学院青少年俱乐部竞技武术学校地址在
学生在外住必拿的东西
推荐资讯
华为荣耀7跟V8那块好点性价比高点
想开早餐店,学做早餐去哪学费用多少
蒲京荣城停车场地址有知道的么?有点事想过去
为什么人多一条染色体就是弱智,为什么不变成
绳约的意思是什么啊?知道的请说下!
大粽子怎么做
龙销商城方城县物流服务中心地址在什么地方,
什么叫做贸易机???
ab+bc=bcb,abc各代表数字几?
假如你正在家里看电视突然贞子从电视里爬出来
葫芦岛上上城宾馆地址在什么地方,想过去办事
本队的意思是什么啊?知道的请说下!
正方形一边上任一点到这个正方形两条对角线的
阴历怎么看 ?