主要内容

本页采用了机器翻译。点击此处可查看英文原文。

使用真实值训练 AI 模型

对真实值数据进行预处理、增强和拆分,用于训练和评估 AI 模型

已标注的真实值数据对于在各种计算机视觉任务(包括目标检测、语义分割、图像分类和视频活动识别)中训练有监督 AI 模型至关重要。Computer Vision Toolbox™ 提供了工具来帮助您准备已标注的真实值数据,用于深度学习训练,包括选择相关标签,修改文件路径,合并真实值目标以及组织训练和评估数据集。

图像标注器视频标注器groundTruth 对象的形式导出已标注的真实值数据。要通过将已标注的真实值转换为与 AI 模型兼容的格式来生成训练数据集,可以使用 objectDetectorTrainingDatapixelLabelTrainingDatasceneLabelTrainingData 等函数。这些函数支持目标检测、分割和分类任务。有关详细信息,请参阅Training Data for Object Detection and Semantic SegmentationPostprocess Exported Labels for Instance Segmentation Training。您还可以使用 polyToBlockedImage 创建分块图像表示,从而高效处理大规模图像。

要从真实值数据中选择特定标签,并根据任务要求过滤和组织注解,可以使用 selectLabelsByGroupselectLabelsByTypeselectLabelsByName 等函数。工具箱还支持使用以下函数对已标注数据进行后处理:merge 用于合并多个真实值目标,changeFilePaths 用于更新数据集引用,以及 gatherLabelData 用于提取标签信息。对于视频数据,writeVideoScenessceneTimeRanges 等实用工具可帮助管理场景级注解。

要与同事共享和审核图像标签,请考虑在图像标注器中创建团队项目。有关详细信息,请参阅Get Started with Team-Based Labeling

App

图像标注器为计算机视觉应用标注图像
视频标注器Label video for computer vision applications

函数

全部展开

selectLabelsByGroupSelect ground truth labels by label group
selectLabelsByTypeSelect ground truth labels by label type
selectLabelsByNameSelect ground truth labels by label name

存储已标注的真实值

groundTruthGround truth label data
pixelLabelDatastoreDatastore for pixel label data
boxLabelDatastoreDatastore for bounding box label data

对已标注的真实值目标进行后处理

mergeMerge two or more ground truth objects (自 R2023b 起)
changeFilePathsChange file paths in ground truth data
writeVideoScenesWrite video sequence to video file (自 R2021b 起)
sceneTimeRangesTime ranges of scene labels from ground truth data (自 R2021b 起)
gatherLabelDataGather label data from ground truth

对标签数据存储进行后处理

combine合并来自多个数据存储的数据
transform变换数据存储
splitlabels查找用于根据指定比例拆分标签的索引
countlabelsCount number of unique labels
countEachLabelCount occurrence of pixel or box labels
folders2labels从文件夹名称中获取标签列表
objectDetectorTrainingDataCreate training data for an object detector
pixelLabelTrainingDataCreate training data for semantic segmentation from ground truth
sceneLabelTrainingDataCreate training data for scene classification from ground truth (自 R2022b 起)
polyToBlockedImageCreate labeled blockedImage object from set of ROIs (自 R2021b 起)
mergeMerge two or more ground truth objects (自 R2023b 起)
attributeTypeAttribute type enumerations for labeling
labelTypeLabel type enumerations for labeling

主题

精选示例