组件Word的图像文字识别功能

图像文字识别  时间:2021-02-25  阅读:()

Word的图像文字识别功能

教你如何将打印稿变成电子稿最近我的一个刚刚走上工作岗位上的朋友老是向我报怨说老板真的是不把我们这些新来工作的人不当人看啊什么粗活都是让我们做这不昨天又拿了10几页的文件拿来 叫他打成电子稿他说都快变成打字工具了我听之后既为他感到同情同时教给他一个简单的方法可以轻松将打印稿变成电子稿我想以后对大家也有用吧拿出来给大家分享一下。首先你得先把这些打印稿或文件通过扫描仪扫到电脑上去一般单位都有扫描仪如果没有也没关系用数码相机拍也行拍成图片放到WORD里面去不过在些之前你还得装一下WO RD自带的组件03和07的都行。点开始-程序-控制面板-添加/删除程序找到Office-修改找到Microsoft Office Document Imaging这个组件Microsoft Office Document Imaging Writer点在本机上运行安装就可以了。

首先将扫描仪安装好接下来从开始菜单启动“Microsoft

Office/ Microsoft Office工具/Microsoft Office DocumentScanning”即可开始扫描。

提示:Office 2003默认安装中并没有这个组件 如果你第一次使用这个功能可能会要求你插入Office2003的光盘进行安装。 由于是文字扫描通常我们选择“黑白模式”  点击扫描开始调用扫描仪自带的驱动进行扫描。这里也要设置为“黑白模式”建议分辨率为300dpi。

扫描完毕后回将图片自动调入Office 2003种另外一个组件

“Microsoft Office Document Imaging”中。

点击工具栏中的“使用OCR识别文字”按键就开始对刚才扫描的文件进行识别了。按下 “将文本发送到Word”按键即可将识别出来的文字转换到Word中去了。如果你要获取部分文字只需要用鼠标框选所需文字然后点击鼠标右键选择“将文本发送到Word”就将选中区域的文字发送到Word中了。

此软件还有一小技巧通过改变选项里的OCR语言可以更准确的提取文字。例如图片里为全英文把OCR语言改为“英语”可以确保其准确率而如果是“默认”则最终出现的可能是乱码

还有

应该说 PDF文档的规范性使得浏览者在阅读上方便了许多但倘若要从里面提取些资料实在是麻烦的可以。回忆起当初做毕业设计时规定的英文翻译痛苦的要命竟然傻到用Print Screen截

取画面到画图板再回粘到word中够白了 最近连做几份商务标书从Honeywel l本部获取的业绩资料全部是英文版的PDF为了不再被折磨花费了一个晚上的时间研究PDF和Word文件的转换找到下面2种方法出于无产阶级所谓的同甘共苦之心共享下 

1、实现工具 Office 2003中自带的Microsoft Office Document Imaging应用情景 目前国外很多软件的支持信息都使用PDF方式进行发布如果没有Adobe Reader无法查看其内容如果没有相关的编辑软件又无法编辑PDF文

件。转换为DOC格式则可以实现编辑功能。尽管有些软件也可以完成PDF转换为DOC的工作但很多都不支持中文我们利用Office 2003中的MicrosoftOffice Document Imaging组件来实现这一要求最为方便。

使用方法

第一步首先使用Adobe Reader打开待转换的PDF文件接下来选择“文件→打印”菜单在打开的“打印”设置窗口中将“打印机”栏中的“名称”设置为“Microsoft Office Document ImageWriter”确认后将该PDF文件输出为MDI格式的虚拟打印文件。

编辑提示如果你在“名称”设置的下拉列表中没有找到“Microsoft OfficeDocument Image Writer”项那证明你在安装Office 2003的时候没有安装该组件请使用Office 2003安装光盘中的“添加/删除组件”更新安装该组件。

第二步 运行Microsoft OfficeDocument Imaging并利用它来打开刚才保存的MDI文件选择“工具→将文本发送到Word”菜单并在弹出的窗口中勾选“在输出时保持图片版式不变”确认后系统提示“必须在执行此操作前重新运行OCR。这可能需要一些时间”不管它 确认即可。

编辑提示 目前包括此工具在内

的所有软件对PDF转DOC的识别率都不是特别完美而且转换后会丢失原来的排版格式所以大家在转换后还需要手工对其进行后期排版和校对工作。

2、实现工具 Sol id Converter PDF应用情景利用Office 2003中的

Microsoft Office Document Imaging组件来实现PDF转Word文档在一定程度上的确可以实现PDF文档到Word文档的转换 但是对于很多“不规则”的PDF文档来说 利用上面的方法转换出来的Word文档中常常是乱码一片。为了恢复PDF的原貌推荐的这种软件可以很好

地实现版式的完全保留无需调整而且可以调整成需要的样板形式。

使用方法

1、下载安装文件Sol id ConverterPDF,点击安装。

编辑提示安装前有个下载安装插件的过程因此需要保证网络连接通畅。

2、运行软件按工具栏要求选择需要转换的PDF文档点击右下的“转换”

Convert按扭选择自己需要的版式根据提示完成转换

ProfitServer$34.56/年,西班牙vps、荷兰vps、德国vps/不限制流量/支持自定义ISO

profitserver怎么样?profitserver是一家成立于2003的主机商家,是ITC控股的一个部门,主要经营的产品域名、SSL证书、虚拟主机、VPS和独立服务器,机房有俄罗斯、新加坡、荷兰、美国、保加利亚,VPS采用的是KVM虚拟架构,硬盘采用纯SSD,而且最大的优势是不限制流量,大公司运营,机器比较稳定,数据中心众多。此次ProfitServer正在对德国VPS(法兰克福)、西班牙v...

青云互联:洛杉矶CN2弹性云限时七折,Cera机房三网CN2gia回程,13.3元/月起

青云互联怎么样?青云互联是一家成立于2020年6月份的主机服务商,致力于为用户提供高性价比稳定快速的主机托管服务,目前提供有美国免费主机、香港主机、香港服务器、美国云服务器,让您的网站高速、稳定运行。目前,美国洛杉矶cn2弹性云限时七折,美国cera机房三网CN2gia回程 13.3元/月起,可选Windows/可自定义配置。点击进入:青云互联官网青云互联优惠码:七折优惠码:dVRKp2tP (续...

华纳云新人下单立减40元/香港云服务器月付60元起,香港双向CN2(GIA)

华纳云(HNCloud Limited)是一家专业的全球数据中心基础服务提供商,总部在香港,隶属于香港联合通讯国际有限公司,拥有香港政府颁发的商业登记证明,保证用户的安全性和合规性。 华纳云是APNIC 和 ARIN 会员单位。主要提供数据中心基础服务、互联网业务解决方案, 以及香港服务器租用、香港服务器托管、香港云服务器、美国云服务器,云计算、云安全技术研发等产品和服务。其中云服务器基于成熟的 ...

图像文字识别为你推荐
google竞价排名哪些搜索引擎没有竞价排名?搜搜?谷歌?站长故事部队里什么是站长?最低是什么级别?都有哪些级别啊?缓冲区溢出教程溢出攻击法使用什么样的原理吴晓波频道买粉《充电时间》的节目跟《吴晓波频道》哪个好听?显卡温度多少正常显卡温度多少算正常镜像文件是什么镜像文件是什么意思?直播加速手机上什么软件可以帮助直播加速,大神们推荐推荐分词技术怎样做好百度分词技术和长尾词优化服务器连接异常lol为什么总是提示服务器连接异常怎么把网页的字变大网页的字很小,怎样调大
虚拟主机管理软件 域名注册信息查询 n点虚拟主机管理系统 已备案域名出售 42u标准机柜尺寸 2017年万圣节 网站实时监控 免费网络电视 京东商城双十一活动 777te 好看qq空间 jsp空间 cdn联盟 免费申请网站 搜索引擎提交入口 双12 国外的代理服务器 万网服务器 nnt hdchina 更多