名词解释 / 03
OCR(文字识别)
第 40 / 127 个名词用 AI 处理文档和公司资料
英文名称:Optical Character Recognition
中文名称:光学字符识别
常见别名:图片转文字、扫描件识别
所属分类:用 AI 处理文档和公司资料
一句话解释
OCR 是把照片、扫描件或图片里的文字识别成可以复制、搜索和进一步处理的文本。
工作中什么时候会遇到
录入发票、送货单、纸质质检表、设备铭牌、合同扫描件或老档案时,工具中的“提取文字”“扫描识别”通常就是 OCR。
能解决什么问题
- 减少纸质单据和图片内容的手工录入。
- 让扫描版 PDF 可以搜索和复制。
- 为合同审核、报销识别和知识库导入提供文本。
- 从表格、票据或证件中提取部分结构化字段。
举个例子
仓库人员拍摄到货单,OCR 自动识别物料编码、数量和日期,再录入系统。正式入库前仍需核对容易混淆的数字、单位和物料型号。
怎么使用
尽量提供清晰、端正、光线均匀的原图,选择适合票据、表格或通用文档的识别模式。识别后重点核对金额、日期、编号、单位和否定性表述,再交给 AI 汇总或分析。
使用时要注意什么
OCR 结果不是原件。模糊照片、印章遮挡、复杂版面、手写体、小字号和相似字符都可能导致错误;表格结构也可能错位。涉及财务、合同、安全生产的数据必须对照原件复核,并遵守公司的数据上传规定。
容易混淆的词
- 计算机视觉:范围更广,可识别物体、场景和缺陷;OCR 专注于文字及版面信息。
- 文档解析:除文字识别外,还可能提取标题、段落、表格和阅读顺序。
- 图像理解:模型可以解释图片内容,但不一定逐字准确转写。