感知机和神经网络:计算机视觉的基本原理
了解神经网络如何改变现代技术,从供应链中的质量控制到使用无人机的自主设施巡检。

在过去的几十年里,neural networks 已成为许多关键人工智能 (AI) 创新的基石。神经网络是试图模拟人脑复杂功能的计算模型。它们帮助机器从 data 中学习并识别模式,从而做出明智的决策。通过这样做,它们使 healthcare、finance 和 self-driving cars 等行业的 computer vision 和 deep learning 等 AI 子领域成为可能。
理解神经网络的工作原理能让你更好地了解作为 AI 的“黑盒”,从而帮助揭开前沿技术如何融入我们日常生活的神秘面纱。在这篇文章中,我们将探讨什么是神经网络、它们如何工作以及它们多年来的演变过程。我们还将了解它们在计算机视觉应用中所扮演的角色。让我们开始吧!
人工智能中的感知器是什么?#
在详细讨论神经网络之前,让我们先来看看感知机。它们是最基本的神经网络类型,也是构建更复杂模型的基础。
感知机是一种用于监督学习(从带标签的训练数据中学习)的线性机器学习算法。它也被称为单层神经网络,通常用于区分两类数据的二分类任务。如果你试图将感知机可视化,你可以把它想象成一个单一的人工神经元。

图 1. 感知机是一个单一的人工神经元。
了解感知器的工作原理#
感知机可以接收多个输入,将它们与权重结合,决定它们属于哪个类别,并充当一个简单的决策者。它由四个主要的参数组成:输入值(也称为节点)、权重和偏置、净和以及激活函数。
它的工作原理如下:
- 输入和权重:假设你有几条信息(输入),每条信息都有一个权重来表示它有多重要。除此之外,偏置还能帮助感知机在做出决策时更具灵活性。
- 计算加权和:感知器将每个输入与其权重相乘,然后将所有结果相加(包括偏置),从而得出加权和。
- 做出决策:然后,感知器使用激活函数来确定最终输出。它利用加权和来决定感知器是否应该激活。在最简单的情况下,激活函数是一个阶跃函数,如果加权和超过某个阈值,则输出 1,否则输出 0。因此,加权输入被转换为“是”或“否”的决策。
- 学习和改进:如果感知机犯了错误,它会调整权重以尝试在下一次做得更好。这个过程有助于模型从错误中学习。

图 2. 感知器概述。来源:indiantechwarrior.com
感知器在计算机视觉中的作用#
感知机在帮助我们理解计算机视觉基础方面发挥着重要作用。它们是高级神经网络的基础。与感知机不同,神经网络不限于单层。它们由多层互联的感知机组成,这使得它们能够学习复杂的非线性模式。神经网络可以处理更高级的任务,并产生二值和连续的输出。例如,神经网络可用于高级计算机视觉任务,如实例分割和姿态估计。
计算机视觉技术从神经网络的演进史#
神经网络的历史可以追溯到几十年前,充满了研究和有趣的发现。让我们仔细看看其中的一些关键事件。
以下是早期里程碑的快速回顾:
- 1940 年代: Warren McCulloch 和 Walter Pitts 开发了一个简单的电路来模拟大脑的工作方式。
- 1958 年: Rosenblatt 引入了感知器。
- **20世纪70年代:**保罗·韦伯斯(Paul Werbos)提出了反向传播的概念(一种通过最小化预测输出与实际输出之间的差异来帮助神经网络学习的训练方法)。反向传播使得训练多层神经网络成为可能,并为深度学习铺平了道路。
- 1980 年代: Geoffrey Hinton 和 Yann LeCun 等研究人员研究了连接主义,即关于互连单元网络如何形成认知过程。他们的工作为现代神经网络奠定了基础。
- 1990 年代: Jürgen Schmidhuber 和 Sepp Hochreiter 提出了长短期记忆 (LSTM) 网络,它已成为涉及序列预测任务的核心。

图 3。神经网络的演变。
进入 21 世纪后,神经网络的研究蓬勃发展,带来了更大的进步。在 2000 年代,Hinton 对受限玻尔兹曼机(一种在数据中发现模式的神经网络)的研究在推动深度学习方面发挥了关键作用。它使深度网络的训练变得更容易,帮助克服了复杂模型的挑战,并使深度学习变得更加实用和有效。
然后,在 2010 年代,由于大数据和并行计算的兴起,研究迅速加速。这一时期的亮点之一是 AlexNet 在 ImageNet 竞赛(2012年)中的胜利。AlexNet 是一个深度卷积神经网络,它是一个重大的突破,因为它展示了深度学习对于计算机视觉任务(例如准确识别图像)的强大威力。它推动了 AI 在视觉识别领域的快速增长。
如今,神经网络正随着各种新创新不断演进,例如非常适合理解序列的transformers,以及擅长处理数据中复杂关系的图神经网络。诸如迁移学习(将针对某项任务训练的模型用于另一项任务)以及模型无需标记数据即可学习的自监督学习等技术,也在不断扩展神经网络的功能。
理解神经网络:基础知识#
既然我们已经打好了基础,让我们来准确了解一下什么是神经网络。神经网络是一种机器学习模型,它使用模仿人脑的分层结构中的互联节点或神经元。这些节点或神经元处理数据并从中学习,使它们能够执行诸如模式识别之类的任务。此外,神经网络具有自适应性,因此它们可以从错误中学习并随着时间的推移不断改进。这使它们能够更准确地解决复杂问题,例如面部识别。

图 4. 神经网络。
神经网络由多个并行工作的处理器组成,按层组织。它们由输入层、输出层和中间的几个隐藏层组成。输入层接收原始数据,类似于我们的视神经接收视觉信息的方式。
然后,每一层将自己的输出传递给下一层,而不是直接处理原始输入,这非常类似于大脑中的神经元相互发送信号的方式。最后一层产生网络的输出。通过这个过程,人工神经网络 (ANN) 可以学会执行计算机视觉任务,例如图像分类。
神经网络在计算机视觉中的工业应用#
在了解了神经网络及其工作原理后,让我们来看看一个展示神经网络在计算机视觉领域潜力的应用。
能源行业的输电线巡检#
神经网络构成了诸如 Ultralytics YOLO11 等计算机视觉模型的基础,并可用于使用无人机对输电线路进行视觉检查。公用事业行业在检查和维护其庞大的输电线路网络时面临着后勤挑战。这些线路通常延伸穿过从繁华的城市地区到偏远、崎岖的地形的一切区域。传统上,这些检查是由地面人员进行的。虽然有效,但这些人工方法成本高昂、耗时,并且会使工人面临环境和电气危险。研究表明,公用事业线路工作是美国十大最危险的工作之一,每 100,000 名工人中有 30 到 50 人的年死亡率。
然而,无人机检查技术可以使航空检查成为一个更实用、更具成本效益的选择。尖端技术使无人机能够在检查过程中无需频繁更换电池即可飞得更远。许多无人机现在集成了 AI,并具有自动避障功能和更好的故障检测能力。这些功能使它们能够在有许多输电线路的拥挤区域进行检查,并在更远的距离捕获高质量图像。许多国家正在采用无人机和计算机视觉进行输电线路检查任务。例如,在爱沙尼亚,100% 的输电线路检查都是由这种无人机完成的。

图 5. 一名技术人员正在使用无人机和 AI 工具巡检输电线(左图)以及他正在操作的无人机(右图)(suasnews)。
关键要点#
神经网络从研究走向应用,已经走过了漫长的道路,并已成为现代技术进步的重要组成部分。它们使机器能够学习、识别模式,并利用所学知识做出明智的决策。从医疗保健、金融到自动驾驶汽车和制造业,这些网络正在推动创新并改变各个行业。随着我们继续探索和优化神经网络模型,它们重新定义我们日常生活和业务运营更多方面的潜力正变得愈发清晰。
要探索更多内容,请访问我们的GitHub仓库,并与我们的社区互动。在我们的解决方案页面上探索制造业和农业中的AI应用。🚀






