名词解释 / 03

OCR(文字识别)

第 40 / 127 个名词用 AI 处理文档和公司资料

英文名称:Optical Character Recognition
中文名称:光学字符识别
常见别名:图片转文字、扫描件识别
所属分类:用 AI 处理文档和公司资料

一句话解释

OCR 是把照片、扫描件或图片里的文字识别成可以复制、搜索和进一步处理的文本。

工作中什么时候会遇到

录入发票、送货单、纸质质检表、设备铭牌、合同扫描件或老档案时,工具中的“提取文字”“扫描识别”通常就是 OCR。

能解决什么问题

  • 减少纸质单据和图片内容的手工录入。
  • 让扫描版 PDF 可以搜索和复制。
  • 为合同审核、报销识别和知识库导入提供文本。
  • 从表格、票据或证件中提取部分结构化字段。

举个例子

仓库人员拍摄到货单,OCR 自动识别物料编码、数量和日期,再录入系统。正式入库前仍需核对容易混淆的数字、单位和物料型号。

怎么使用

尽量提供清晰、端正、光线均匀的原图,选择适合票据、表格或通用文档的识别模式。识别后重点核对金额、日期、编号、单位和否定性表述,再交给 AI 汇总或分析。

使用时要注意什么

OCR 结果不是原件。模糊照片、印章遮挡、复杂版面、手写体、小字号和相似字符都可能导致错误;表格结构也可能错位。涉及财务、合同、安全生产的数据必须对照原件复核,并遵守公司的数据上传规定。

容易混淆的词

  • 计算机视觉:范围更广,可识别物体、场景和缺陷;OCR 专注于文字及版面信息。
  • 文档解析:除文字识别外,还可能提取标题、段落、表格和阅读顺序。
  • 图像理解:模型可以解释图片内容,但不一定逐字准确转写。

相关名词

文件解析多模态模型知识库

参考来源