OCR
表示“Optical Character Recognition”。OCR 是一种能够识别 数字图像中文字的技术。它通常用于识别扫描的文档中的文字,但也有许多其他用途。
OCR 软件通过定位和识别字符(例如字母、数字和符号)来处理数字图像。有些 OCR 软件只会导出文字,而其他程序可以直接将图像中的字符转换为可编辑文本。高级 OCR 软件不仅可以导出文字的大小和格式,还可以导出页面中文字的布局。
OCR 技术可用于将文档的硬拷贝转换为电子版本或(软拷贝)。例如,如果你将多页文档扫描成数字图像如 (TIFF 文件),就可以将该文档加载到 OCR 程序中。程序会识别其中的文字,并将文档转换为可编辑的文本文件。有些 OCR 程序允许你扫描文档,并在一步操作中将其转换为文字处理文档。
虽然 OCR 技术最初是为识别印刷文字而设计的,但它同样可以用于识别和验证手写文字。例如,USPS 等邮政服务会使用 OCR 软件,根据地址自动处理信件和包裹。该算法会将扫描的信息与现有地址数据库进行比对,以确认邮寄地址。Google Translate 应用包含可与设备摄像头配合使用的 OCR 技术。它可以让你从文档、杂志、标志和其他物体中捕获文字,并在实时将其翻译成另一种语言。
测试你的知识