主要内容

本页采用了机器翻译。点击此处可查看英文原文。

Computer Vision Toolbox

Computer Vision Toolbox™ 提供用于设计和测试计算机视觉系统的算法和 App。您可以执行视觉检查、目标检测和跟踪,以及特征检测、提取和匹配。您可以自动化单目相机、鱼眼相机、立体相机和多相机配置的标定工作流。对于三维视觉,工具箱支持立体视觉、点云处理、运动重建以及实时视觉和点云 SLAM。计算机视觉 App 支持基于团队的真实值自动标注,以及相机标定。

工具箱提供了多种 AI 技术,包括预训练卷积神经网络 (CNN)、视觉变换器和视觉语言模型。使用开箱即用的模型来执行图像分类、目标检测、分割、位姿估计、图像描述和光学字符识别 (OCR) 等任务,或通过迁移学习进一步自定义这些模型。

您可以生成 C、C++ 代码、用于 GPU 执行的代码以及硬件描述语言 (HDL) 代码。

Computer Vision Toolbox 快速入门

Computer Vision Toolbox 基础知识学习

检测、提取和匹配特征

检测兴趣点、提取特征描述符、匹配特征、配准和检索图像

真实值图像和视频

使用 AI 辅助自动标注以交互方式标注图像和视频,创建 AI 模型的训练数据,并管理面向大型数据集的协作团队标注

检测和分割目标

使用 AI 模型检测目标、识别文本 (OCR)、检测条形码和基准标记,执行语义分割和实例分割

对图像和视频进行分类

使用 AI 模型对图像和视频进行分类并执行活动识别

视觉语言模型

使用视觉语言模型执行图像分类、检索、描述和目标检测任务

标定相机

自动执行单目相机、鱼眼相机、立体相机、多相机和机器人手眼配置的内参和外参标定工作流

三维视觉

估计相机位姿、执行立体视觉、基于立体视觉或运动重建 (SfM) 来重建三维场景、实现实时视觉 SLAM 及惯性传感器融合

跟踪目标和估计运动

跟踪多个目标、跟踪特征点、目标重识别 (ReID)、光流和模板匹配