跳到主要内容

批量测试-文字识别OCR

把 OCR 模型识别出的文字和预设类别列表进行比较,并按结果分类保存。

img_10.png

输出目录

OCR 批量预测时必须选择输出目录,否则无法保存图像。

OCR 匹配设置

  • 类别列表文件

    类别列表文件为 .txt 文件,每行填写一个允许的完整类别。批量预测时,识别文字会与这些类别进行比较。

  • 匹配成功:处理后的识别文字属于类别列表中的某个类别,判定为 OK,结果保存至原图文件夹。

  • 匹配失败:处理后的识别文字不在类别列表中,判定为 NG,结果保存至 NG 文件夹。

案例展示

类别列表文件中每行填写一个类别。下面的文件包含 47025V 两个类别:

img_11.png

批量预测完成后,匹配成功的结果保存至原图文件夹,匹配失败的结果保存至 NG 文件夹。

img_14.png

模糊匹配

模糊匹配使用另一份 .txt 映射文件。每行必须包含两列,并使用一个或多个空格或制表符分隔:左列是可能识别出的字符,右列是比较前替换成的字符。程序只读取恰好两列的行。

例如:

O 0
o 0
I 1
l 1
Z 2
S 5
B 8

以上设置会在类别比较前把左列字符替换为右列字符。类别列表文件与模糊匹配文件是两个独立文件。

按以下步骤设置模糊匹配:

  1. 在文本文件中填写字符替换关系,每行一组,例如 O 0
  2. 打开“设置”中的“批量预测-OCR”,勾选“保存原图”,选择输出目录。
  3. 在“类别列表文件”中选择包含完整类别的文本文件。
  4. 在“模糊匹配”中选择字符映射文件,如下图所示。

img_13.png

典型问题示例

期望类别OCR 可能识别结果未设置映射设置映射后
0O 或 oNGOK
1I 或 lNGOK
5SNGOK
8BNGOK

使用场景

场景是否设置模糊匹配文件
纯数字检测(0-9)可按常见误识别字符设置
纯字母检测(A-Z)可按常见误识别字符设置
数字与字母混合(如车牌)谨慎设置,避免把需要区分的字符互相替换