2025 年计算机视觉相机标定指南
了解相机标定如何通过校正畸变、改进深度估计和提升准确性,增强各种计算机视觉应用中的视觉 AI。

相机并不像人类那样看待世界。很多时候,相机会拍摄出存在畸变和透视偏移的图像,从而影响视觉 AI 模型的准确性。相机标定可以修正这些畸变,确保计算机视觉模型能够按照物体在现实世界中的实际样子来感知它们。这一过程包括修正镜头畸变、调整焦距以及对齐传感器,帮助相机捕捉准确的图像。
具体来说,准确的相机标定对于正确估计深度和测量距离至关重要。像Ultralytics YOLO11这样的视觉 AI 模型需要经过良好标定的输入,才能执行目标检测和姿态估计等各种计算机视觉任务。如果输入图像不准确,模型性能可能会下降,并在现实应用中导致错误。
从传统的棋盘格图案到先进的 AI 驱动技术,不同的相机标定方法都可以帮助提升精度。例如,三维(3D)标定可以帮助模型理解深度,而标定矩阵则可将现实世界坐标转换到图像空间,从而提高准确性。
本指南将介绍计算机视觉相机标定的基础知识,包括关键参数、不同方法,以及面向现实世界 AI 应用的优化。
相机标定在计算机视觉中的重要性#
相机标定用于调整相机设置,确保图像与现实世界的测量结果准确匹配。它可以保证图像中的物体具有正确的位置、大小和比例,避免可能误导 AI 模型的畸变。
如果缺乏适当的标定,相机可能会产生镜头畸变,使物体看起来被拉伸或错位。这会影响目标检测、跟踪和深度估计的准确性,进而导致 AI 驱动应用出现错误。尤其是像 Ultralytics YOLO11 这样的模型,在输入数据经过正确标定时能够更有效地运行,从而减少空间解释中的错误,并改善现实世界中的决策。
在无人机、自动驾驶汽车和机器人视觉中,准确的标定尤其重要。这些系统中的错位可能导致距离计算错误,影响导航和障碍物检测等任务。

图 1。使用相机标定修正镜头畸变的示例(左侧为畸变,右侧为修正结果)。
探索镜头畸变的影响#
镜头畸变可能导致相机错误地呈现图像中物体的形状和位置。以下是不同类型镜头畸变的一些示例:
- 桶形畸变:在这种情况下,直线会显得向外弯曲,使图像中心的物体看起来膨胀。这种畸变常见于广角镜头,并可能通过扭曲深度感知来干扰自动驾驶系统中的三维(3D)标定。
- 枕形畸变:在这种情况下,直线会朝图像中心向内弯曲,产生与桶形畸变相反的效果。
- 胡子畸变:当桶形畸变和枕形畸变同时出现时,就会产生这种畸变,使直线以波浪状弯曲。
- 色差:当镜头无法将不同颜色聚焦在同一点上时,就会出现这种现象,在物体周围形成彩色边缘。

图 2。不同类型的镜头畸变。
相机标定的类型#
相机标定由两个关键部分组成:内参用于定义相机的内部特性,外参用于确定相机相对于世界的位置和方向。下面将分别详细了解这两类参数。
内参#
精确的内参标定可以确保检测到的物体在现实应用中具有正确的位置和尺度,从而提升模型预测效果。下面简要介绍几个内参:
- 焦距: 它控制相机如何将三维(3D)物体投影到二维(2D)图像上。如果标定不准确,物体可能会显得被拉伸或压缩,改变其感知到的大小和距离。
- 主点: 它表示相机传感器的光学中心。如果发生偏移,可能会使整幅图像移动,导致物体位置错位。
- 倾斜系数: 它用于描述传感器中非矩形的像素排列。当存在倾斜时,图像可能会显得倾斜或变形,而不是保持正确对齐。
- 畸变系数: 这些参数用于修正镜头造成的光学畸变。如果不进行修正,直线可能会显得弯曲,尤其是在图像边缘附近。
外参#
外参标定用于确定相机相对于现实世界的位置和方向,这对于用于三维(3D)标定、目标跟踪和深度感知的多相机系统尤为重要。它可以帮助无人机、自动驾驶车辆和监控系统准确理解空间关系。
以下是两个关键的外参:
- 平移矩阵: 它定义相机在三维(3D)空间中的物理位置,指定相机沿 X、Y 和 Z 轴的位置。如果标定不准确,物体可能会显得比实际更近或更远,导致距离测量错误。在自动驾驶车辆中,这可能导致障碍物检测效果不佳;在机器人系统中,则可能在操作物体时造成定位错误。
- 旋转矩阵: 它通过指定相机相对于参考点的倾斜、旋转或偏转程度来确定相机的方向。如果标定不正确,来自多个相机的图像可能无法正确对齐,从而影响三维(3D)重建、多相机跟踪和空间映射。例如,在自动驾驶汽车中,错误的旋转矩阵可能使传感器输入错位,导致车道检测不准确。
了解相机标定矩阵#
相机捕捉到的每幅图像都是三维(3D)世界的二维(2D)表示。AI 模型需要一种在这两个维度之间进行转换的方法,才能做出准确的预测。这就是相机标定矩阵发挥作用的地方。它将现实世界中的点映射到相机的图像平面上,使物体呈现出正确的位置。
简单来说,相机标定矩阵是表示相机内参的数学模型。它通常存储在视觉系统中,并用于图像处理算法,以修正畸变并将三维(3D)点映射为二维(2D)坐标。
正如下一节将介绍的,矩阵可以通过棋盘格图案检测、基于三维物体的标定以及 AI 驱动的自标定等方法计算得出。这些方法通过分析已知参考点的图像来估计关键参数。
各种相机标定方法#
相机标定有多种方法,每种方法都适用于特定的使用场景。传统方法依赖实体图案,而 AI 驱动技术则使用深度学习来自动完成这一过程。
下面让我们逐一了解这些方法,探索它们如何提升不同应用中的准确性。
传统相机标定方法#
最常见的相机标定方法之一,是在相机前方放置棋盘格或网格图案。系统会检测图案中的关键点,以计算标定参数。

图 3。相机标定棋盘格。
虽然这种方法在受控环境中很有用,但需要手动调整,并分析来自不同角度的多幅图像。光照条件变化或相机意外移动都可能降低准确性,因此需要重新标定。
在无人机和自动驾驶汽车等动态环境中,传统标定方法难以跟上变化。移动的相机需要频繁重新标定以保持精度,而静态图案无法实用地满足这一要求。这一局限推动了 AI 驱动相机标定技术的发展,使标定更加灵活和自动化。
AI 驱动的相机标定方法#
AI 驱动技术使用深度学习模型进行自标定,从而自动完成相机标定并减少手动调整的需求。这些方法直接从现实世界图像中估计内参和外参,无需预先定义的图案。
同样,合成数据集也在改变相机标定方式:它们为 AI 模型提供多样且带标签的训练数据,以优化参数并修正畸变。这些数据集能够模拟现实世界条件,帮助 AI 模型在无需人工输入的情况下学习动态调整内参和外参。
例如,自标定框架使用概率模型和深度学习来分析单目图像、估计三维(3D)结构并持续优化标定过程。合成数据通过训练模型处理不同视角、传感器错位和光照条件来增强这一过程,从而提升自动驾驶和机器人等应用中的深度估计、障碍物跟踪和空间精度。

图 4。能够理解交通状况的自标定视觉 AI 系统。
相机标定的关键应用#
现在我们已经了解了相机标定是什么,下面来探索它对各个行业的影响。
自动驾驶车辆与无人机导航#
对于自动驾驶汽车和自主无人机而言,精确的相机标定对于实现安全可靠的导航十分重要。这些系统依靠深度估计和距离计算来检测障碍物、跟踪道路标线并评估周围物体。标定不佳可能导致距离判断错误,进而在实时场景中做出错误决策。
经过正确标定的矩阵可以让自动驾驶车辆融合 LiDAR、雷达和相机的输入,从而改善多传感器融合。这有助于车辆准确判断与行人、车道边界和附近车辆之间的距离,降低事故风险。同时,在无人机中,三维(3D)标定有助于保持高度稳定,并准确跟踪物体,从而在动态环境中实现精确导航。

图 5。自动驾驶汽车中的标定相机。
增强现实(AR)与虚拟现实(VR)#
AR 和 VR 应用依靠精确的相机标定,将数字内容与现实世界中的物体对齐。如果标定不正确,AR 叠加内容可能会漂移、出现错位或缩放不正确,从而影响用户体验。
镜头畸变修正是让虚拟物体无缝融入真实环境的关键。没有这项修正,畸变可能会破坏沉浸感,并降低游戏、训练模拟和医学成像中的准确性。此外,在 VR 中,标定可以增强对头部和手部运动的准确跟踪,提高响应速度,带来更流畅、更具沉浸感的体验。

图 6。用于优化空间测量的三维(3D)相机标定设置。
机器人视觉与工业自动化#
要让机器人准确地观察并与世界交互,适当的相机标定至关重要。在工业自动化中,机器人依靠深度估计来精确地拾取、放置和操作物体。如果缺乏适当的标定,错位可能导致包装、装配和质量控制检查出现错误。
机器人技术面临的一项关键挑战,是准确测量平面物体。标定可以帮助机械臂检测精确尺寸,避免可能减慢或中断生产的计算错误。三维(3D)标定则更进一步,使机器人能够在物体或位置发生变化时进行适应。
要点总结#
相机标定是许多计算机视觉解决方案的关键组成部分。它确保 AI 模型能够准确解读图像,以执行目标检测、跟踪和深度估计等任务。内参和外参有助于将图像与现实世界的测量结果对齐,避免可能影响 AI 驱动应用的畸变。
镜头畸变修正对于增强现实应用、工业自动化和多相机系统至关重要。随着 AI 的发展,自动相机标定方法正在提升现实应用中的效率、准确性和长期可靠性。









