欢迎来到天天文库
浏览记录
ID:34022107
大小:59.30 KB
页数:6页
时间:2019-03-03
《如何将文本该成电子版··》由会员上传分享,免费在线阅读,更多相关内容在应用文档-天天文库。
1、教你如何将打印稿变成电子稿最近,我的一个刚刚走上工作岗位上的朋友老是向我报怨,说老板真的是不把我们这些新来工作的人不当人看啊,什么粗活都是让我们做,这不,昨天又拿了10几页的文件拿来,叫他打成电子稿,他说都快变成打字工具了,我听之后既为他感到同情,同时教给他一个简单的方法,可以轻松将打印稿变成电子稿,我想以后对大家也有用吧,拿出来给大家分享一下。 首先你得先把这些打印稿或文件通过扫描仪扫到电脑上去,一般单位都有扫描仪,如果没有也没关系,用数码相机拍也行,拍成图片放到WORD里面去,不过在些之前,你还得装一下W
2、ORD自带的组件,03和07的都行。点开始-程序-控制面板-添加/删除程序,找到Office-修改找到MicrosoftOfficeDocumentImaging这个组件,MicrosoftOfficeDocumentImagingWriter点在本机上运行,安装就可以了。首先将扫描仪安装好,接下来从开始菜单启动“MicrosoftOffice/MicrosoftOffice工具/MicrosoftOfficeDocumentScanning”即可开始扫描。 提示:Office2003默认安装中并没有这个组
3、件,如果你第一次使用这个功能可能会要求你插入Office2003的光盘进行安装。由于是文字扫描通常我们选择“黑白模式”,点击扫描,开始调用扫描仪自带的驱动进行扫描。这里也要设置为“黑白模式”,建议分辨率为300dpi。扫描完毕后回将图片自动调入Office2003种另外一个组件“MicrosoftOfficeDocumentImaging”中。 点击工具栏中的“使用OCR识别文字”按键,就开始对刚才扫描的文件进行识别了。按下“将文本发送到Word”按键即可将识别出来的文字转换到Word中去了。如果你要获取部
4、分文字,只需要用鼠标框选所需文字,然后点击鼠标右键选择“将文本发送到Word”就将选中区域的文字发送到Word中了。 此软件还有一小技巧:通过改变选项里的OCR语言,可以更准确的提取文字。例如图片里为全英文,把OCR语言改为“英语”可以确保其准确率,而如果是“默认”则最终出现的可能是乱码~ 应该说,PDF文档的规范性使得浏览者在阅读上方便了许多,但倘若要从里面提取些资料,实在是麻烦的可以。回忆起当初做毕业设计时规定的英文翻译,痛苦的要命,竟然傻到用PrintScreen截取画面到画图板,再回粘到word中,
5、够白了:(最近连做几份商务标书,从Honeywell本部获取的业绩资料全部是英文版的PDF,为了不再被折磨,花费了一个晚上的时间研究PDF和Word文件的转换,找到下面2种方法,出于无产阶级所谓的同甘共苦之心,共享下:) 1、实现工具:Office2003中自带的MicrosoftOfficeDocumentImaging 应用情景:目前国外很多软件的支持信息都使用PDF方式进行发布,如果没有AdobeReader,无法查看其内容,如果没有相关的编辑软件又无法编辑PDF文件。转换为DOC格式则可以实现编辑功
6、能。尽管有些软件也可以完成PDF转换为DOC的工作,但很多都不支持中文,我们利用Office2003中的MicrosoftOfficeDocumentImaging组件来实现这一要求最为方便。 使用方法: 第一步:首先使用AdobeReader打开待转换的PDF文件,接下来选择“文件→打印”菜单,在打开的“打印”设置窗口中将“打印机”栏中的“名称”设置为“MicrosoftOfficeDocumentImageWriter”,确认后将该PDF文件输出为MDI格式的虚拟打印文件。 编辑提示:如果你在“名称
7、”设置的下拉列表中没有找到“MicrosoftOfficeDocumentImageWriter”项,那证明你在安装Office2003的时候没有安装该组件,请使用Office2003安装光盘中的“添加/删除组件”更新安装该组件。 第二步:运行MicrosoftOfficeDocumentImaging,并利用它来打开刚才保存的MDI文件,选择“工具→将文本发送到Word”菜单,并在弹出的窗口中勾选“在输出时保持图片版式不变”,确认后系统提示“必须在执行此操作前重新运行OCR。这可能需要一些时间”,不管它,
8、确认即可。 编辑提示:目前,包括此工具在内的所有软件对PDF转DOC的识别率都不是特别完美,而且转换后会丢失原来的排版格式,所以大家在转换后还需要手工对其进行后期排版和校对工作。 2、实现工具:SolidConverterPDF 应用情景:利用Office2003中的MicrosoftOfficeDocumentImaging组件来实现PDF转Word文档在一定程度上的确可以实现PDF文档
此文档下载收益归作者所有