计算机视觉入门——概论与基础知识

1.基本概念:

计算机视觉是指用计算机实现人的视觉功能,主要针对对客观世界三维场景的感知、识别和理解。计算机视觉的目标是使计算机具有通过二维图像认知三维环境信息的能力,不仅需要使计算机能够感知三维环境中物体的几何信息(包括形状、位置、运动等),而且能对信息进行描述、存储、识别和理解。

2. 计算机视觉的关键任务:

  1. 物体识别:识别图像物体属于的类别
  2. 物体检测:用框去标出物体的位置,并给出物体的类别
  3. 分类/定位:分类即给输入图像分配标签,定位即找到图像中某一目标物体在图像中的位置
  4. 图像分割:将数字图像细分为多个子区域(超像素,ROI)

3.OpenCV应用领域:

计算机视觉、人机交互、物体识别、图像分割、人脸识别、动作识别、运动跟踪、机器人、运动分析、机器视觉、结构分析、汽车安全驾驶

4.相关背景知识:

  1. 图像数据的操作:分配、释放、复制、设置和转换。 图像是视频的输入输出I/O ,文件与摄像头的输入、图像和视频文件输出)。
  2. 矩阵和向量的操作以及线性代数的算法程序:矩阵积、解方程、特征值以及奇异值等。
  3. 各种动态数据结构:列表、队列、集合、树、图等。
  4. 基本的数字图像处理:滤波、边缘检测、角点检测、采样与差值、色彩转换、形态操作、直方图、图像金字塔等。
  5. 结构分析:连接部件、轮廓处理、距离变换、各自距计算、模板匹配、Hough变换、多边形逼近、直线拟合、椭圆拟合、Delaunay三角划分等。
  6. 摄像头定标:发现与跟踪定标模式、定标、基本矩阵估计、齐次矩阵估计、立体对应。
  7. 运动分析:光流、运动分割、跟踪。
  8. 目标识别:特征法、隐马尔可夫模型:HMM。
  9. 基本的GUI:图像与视频显示、键盘和鼠标事件处理、滚动条。
  10. 图像标注:线、二次曲线、多边形、画文字。

5.计算机视觉在工业界的应用(典型公司):

国内:blog..net/hduxiejun/article/details/53725836

国外:blog..net/elaine_bao/article/details/50655514

经验分享 程序员 微信小程序 职场和发展