AI模型
AI 模型模块集成了图像分类、目标检测、实例分割 、语义分割、文字识别(OCR)等常见的任务类型。
图像分类

参数设置与功能说明
| 参数 | 默认值 | 说明 |
|---|---|---|
| 模型文件 | 空 | 点击"选择模型文件"按钮从本地, 加载训练好的分类模型(dvp、dvt格式) |
| TOP_K | 1 | 返回置信度最高的前 K 个类别。设为 1 ,输出分数最高类别; |
| BATCH_SIZE | 16 | 批量推理大小,一次同时处理 16 张图; 显存充足可增大,显存紧张可减小 |
输入输出说明

输入
-
图像:待分类检测的图像数据
-
结果:上一节点传递的参数,如检测框坐标、掩码、预处理参数等。
输出
-
图像:与输入图像一致。
-
结果:分类结果数据,如类别标签、置信度、Top-K 列表等
目标检测

参数设置与功能说明
| 参数 | 默认值 | 说明 |
|---|---|---|
| 模型文件 | 空 | 点击"选择模型文件"按钮从本地, 加载训练好的检测模型(dvp、dvt格式) |
| 置信度 | 0.5 | 检测置信度值,低于此值的检测结果会被过滤掉 |
| IOU阈值 | 0.2 | NMS(非极大值抑制)的 IOU 阈值,控制重叠框的合并策略 |
输入输出说明

输入
- 图像:待检测的图像。
输出
-
图像:与输入图像一致。
-
结果:目标检测结果,如类别标签、置信度、Bbox坐标、Bbox宽高等。
实例分割 \ 语义分割

参数设置与功能说明
| 参数 | 默认值 | 说明 |
|---|---|---|
| 模型文件 | 空 | 点击"选择模型文件"按钮从本地, 加载训练好的分割模型(dvp、dvt格式) |
| 置信度 | 0.5 | 检测置信度值,低于此值的检测结果会被过滤掉 |
| IOU阈值 | 0.2 | NMS(非极大值抑制)的 IOU 阈值,控制重叠框的合并策略 |
输入输出说明

输入
- 图像:待检测的图像。
输出
-
图像:与输入图像一致。
-
结果:实例分割检测结果,如类别标签、置信度、Bbox坐标、Bbox宽高、Mask面积等。
文字识别(OCR)
参数设置与功能说明
| 参数 | 默认值 | 说明 |
|---|---|---|
| 模型文件 | 空 | 点击"选择模型文件"按钮从本地, 加载训练好的OCR模型(dvp、dvt格式) |
| TOP_K | 1 | 返回置信度最高的前 K 个类别识别结果,设为 1 只输出最佳结果;设为 N 则输出 Top-N 候选 |
| BATCH_SIZE | 16 | 批量推理大小,一次同时处理 16 张文本区域图像 |
| 使用曲线拉直图像 | ✅勾选 | 是否使用前置模块的曲线拉直图像 |
输入输出说明

输入
-
图像:待识别的文本区域图像
-
结果:上游节点传递的检测结果,如检测框坐标、区域信息、预处理参数等
输出
-
图像:与输入图像一致
-
结果:识别结果,如文本内容、置信度等