跳到主要内容

AI模型

AI 模型模块集成了图像分类、目标检测、实例分割 、语义分割、文字识别(OCR)等常见的任务类型。

图像分类

image66.png

参数设置与功能说明

参数默认值说明
模型文件点击"选择模型文件"按钮从本地, 加载训练好的分类模型(dvp、dvt格式)
TOP_K1返回置信度最高的前 K 个类别。设为 1 ,输出分数最高类别;
BATCH_SIZE16批量推理大小,一次同时处理 16 张图; 显存充足可增大,显存紧张可减小

输入输出说明

image67.png

输入

  • 图像:待分类检测的图像数据

  • 结果:上一节点传递的参数,如检测框坐标、掩码、预处理参数等。

输出

  • 图像:与输入图像一致。

  • 结果:分类结果数据,如类别标签、置信度、Top-K 列表等

目标检测

image68.png

参数设置与功能说明

参数默认值说明
模型文件点击"选择模型文件"按钮从本地, 加载训练好的检测模型(dvp、dvt格式)
置信度0.5检测置信度值,低于此值的检测结果会被过滤掉
IOU阈值0.2NMS(非极大值抑制)的 IOU 阈值,控制重叠框的合并策略

输入输出说明

image69.png

输入

  • 图像:待检测的图像。

输出

  • 图像:与输入图像一致。

  • 结果:目标检测结果,如类别标签、置信度、Bbox坐标、Bbox宽高等。

实例分割 \ 语义分割

image70.png

参数设置与功能说明

参数默认值说明
模型文件点击"选择模型文件"按钮从本地, 加载训练好的分割模型(dvp、dvt格式)
置信度0.5检测置信度值,低于此值的检测结果会被过滤掉
IOU阈值0.2NMS(非极大值抑制)的 IOU 阈值,控制重叠框的合并策略

输入输出说明

image71.png

输入

  • 图像:待检测的图像。

输出

  • 图像:与输入图像一致。

  • 结果:实例分割检测结果,如类别标签、置信度、Bbox坐标、Bbox宽高、Mask面积等。

文字识别(OCR)

参数设置与功能说明

参数默认值说明
模型文件点击"选择模型文件"按钮从本地, 加载训练好的OCR模型(dvp、dvt格式)
TOP_K1返回置信度最高的前 K 个类别识别结果,设为 1 只输出最佳结果;设为 N 则输出 Top-N 候选
BATCH_SIZE16批量推理大小,一次同时处理 16 张文本区域图像
使用曲线拉直图像✅勾选是否使用前置模块的曲线拉直图像

输入输出说明

image72.png

输入

  • 图像:待识别的文本区域图像

  • 结果:上游节点传递的检测结果,如检测框坐标、区域信息、预处理参数等

输出

  • 图像:与输入图像一致

  • 结果:识别结果,如文本内容、置信度等