批量测试-文字识别OCR
把 OCR 模型识别出的文字和预设类别列表进行比较,并按结果分类保存。

输出目录
OCR 批量预测时必须选择输出目录,否则无法保存图像。
OCR 匹配设置
-
类别列表文件
类别列表文件为
.txt文件,每行填写一个允许的完整类别。批量预测时,识别文字会与这些类别进行比较。 -
匹配成功:处理后的识别文字属于类别列表中的某个类别,判定为 OK,结果保存至原图文件夹。
-
匹配失败:处理后的识别文字不在类别列表中,判定为 NG,结果保存至 NG 文件夹。
案例展示
类别列表文件中每行填写一个类别。下面的文件包含 470 和 25V 两个类别:

批量预测完成后,匹配成功的结果保存至原图文件夹,匹配失败的结果保存至 NG 文件夹。

模糊匹配
模糊匹配使用另一份 .txt 映射文件。每行必须包含两列,并使用一个或多个空格或制表符分隔:左列是可能识别出的字符,右列是比较前替换成的字符。程序只读取恰好两列的行。
例如:
O 0
o 0
I 1
l 1
Z 2
S 5
B 8
以上设置会在类别比较前把左列字符替换为右列字符。类别列表文件与模糊匹配文件是两个独立文件。
按以下步骤设置模糊匹配:
- 在文本文件中填写字符替换关系,每行一组,例如
O 0。 - 打开“设置”中的“批量预测-OCR”,勾选“保存原图”,选择输出目录。
- 在“类别列表文件”中选择包含完整类别的文本文件。
- 在“模糊匹配”中选择字符映射文件,如下图所示。

典型问题示例
| 期望类别 | OCR 可能识别结果 | 未设置映射 | 设置映射后 |
|---|---|---|---|
| 0 | O 或 o | NG | OK |
| 1 | I 或 l | NG | OK |
| 5 | S | NG | OK |
| 8 | B | NG | OK |
使用场景
| 场景 | 是否设置模糊匹配文件 |
|---|---|
| 纯数字检测(0-9) | 可按常见误识别字符设置 |
| 纯字母检测(A-Z) | 可按常见误识别字符设置 |
| 数字与字母混合(如车牌) | 谨慎设置,避免把需要区分的字符互相替换 |