感知器与神经网络:计算机视觉基本原理
了解神经网络如何改变现代技术,从供应链质量控制到使用无人机进行自主公用设施检查。

在过去几十年里,神经网络已成为许多关键人工智能 (AI) 创新的基础。神经网络是试图模拟人脑复杂功能的计算模型。它们帮助机器从数据中学习并识别模式,从而做出明智的决策。通过这种方式,它们推动了计算机视觉和深度学习等 AI 子领域在医疗保健、金融和自动驾驶汽车等行业中的发展。
了解神经网络的工作原理,可以帮助你更好地理解 AI 这个“黑箱”,消除对前沿技术如何融入我们日常生活的神秘感。在本文中,我们将探讨神经网络是什么、如何工作,以及它们多年来如何演变。我们还将了解它们在计算机视觉应用中发挥的作用。让我们开始吧!
AI 中的感知器是什么?#
在详细讨论神经网络之前,我们先来看看感知器。感知器是最基本的神经网络类型,也是构建更复杂模型的基础。
感知器是一种线性机器学习算法,用于监督学习(从带标签的训练数据中学习)。它也被称为单层神经网络,通常用于二分类任务,以区分两类数据。如果你想直观地理解感知器,可以把它看作一个单一的人工神经元。

图 1。感知器是一个单一的人工神经元。
了解感知器的工作原理#
感知器可以接收多个输入,将它们与权重结合,判断它们所属的类别,并充当简单的决策器。它由四个主要参数组成:输入值(也称为节点)、权重和偏置、净和以及激活函数。
它的工作原理如下:
- 输入和权重:假设你有几条信息(输入),每条输入都有一个权重,用于表示其重要程度。此外,偏置可以帮助感知器更灵活地做出决策。
- 计算加权和:感知器将每个输入乘以其权重,然后将所有结果(包括偏置)相加,得到加权和。
- 做出决策:接下来,感知器使用激活函数确定最终输出。它获取加权和,并判断感知器是否应当激活。在最简单的情况下,激活函数是阶跃函数:当加权和高于某个阈值时输出 1,否则输出 0。因此,加权输入会被转换为“是”或“否”的决策。
- 学习和改进:如果感知器出错,它会调整权重,争取下次做得更好。这个过程帮助模型从错误中学习。

图 2。感知器概览。来源:indiantechwarrior.com
感知器在计算机视觉中的作用#
感知器在帮助我们理解计算机视觉基础方面发挥着重要作用。它们是高级神经网络的基础。与感知器不同,神经网络并不局限于单层。它们由多个相互连接的感知器层组成,因此能够学习复杂的非线性模式。神经网络可以处理更高级的任务,并生成二值和连续输出。例如,神经网络可用于高级计算机视觉任务,如实例分割和姿态估计。
神经网络推动计算机视觉技术的发展#
神经网络的历史可以追溯到几十年前,其中充满了研究和有趣的发现。让我们进一步了解其中一些关键事件。
以下是早期重要里程碑的简要概览:
- **20 世纪 40 年代:**Warren McCulloch 和 Walter Pitts 开发了一种模拟大脑工作方式的简单电路。
- **1958 年:**Rosenblatt 提出了感知器。
- **20 世纪 70 年代:**Paul Werbos 提出了反向传播的概念(一种通过最小化预测输出与实际输出之间的差异来帮助神经网络学习的训练方法)。反向传播使训练多层神经网络成为可能,并为深度学习铺平了道路。
- **20 世纪 80 年代:**Geoffrey Hinton 和 Yann LeCun 等研究人员研究了联结主义,即相互连接的单元如何形成认知过程。他们的工作为现代神经网络奠定了基础。
- **20 世纪 90 年代:**Jürgen Schmidhuber 和 Sepp Hochreiter 提出了长短期记忆网络 (LSTM),该网络已成为处理序列预测任务的关键技术。

图 3。神经网络的发展。
进入 21 世纪后,神经网络研究迅速发展,带来了更大的进步。在 21 世纪 00 年代,Hinton 对受限玻尔兹曼机的研究发挥了关键作用。受限玻尔兹曼机是一种能够从数据中发现模式的神经网络。该研究使深度网络更容易训练,有助于克服复杂模型带来的挑战,并让深度学习更加实用和高效。
随后,在 21 世纪 10 年代,随着大数据和并行计算的兴起,研究快速加速。这一时期的亮点之一是 AlexNet 在 ImageNet 竞赛中获胜(2012 年)。AlexNet 是一种深度卷积神经网络,它展示了深度学习在计算机视觉任务(如准确识别图像)方面的强大能力,因而成为重大突破。它推动了 AI 在视觉识别领域的快速发展。
如今,神经网络正随着Transformer等新创新不断发展。Transformer 擅长理解序列,图神经网络则适合处理数据中的复杂关系。迁移学习等技术——即将针对一个任务训练的模型用于另一个任务——以及自监督学习(模型无需带标签的数据即可学习),也在不断拓展神经网络的能力。
了解神经网络:基础知识#
现在我们已经了解了相关基础,接下来具体看看神经网络究竟是什么。神经网络是一种机器学习模型,使用按层组织的相互连接节点或神经元,其结构类似于人脑。这些节点或神经元处理数据并从中学习,使其能够执行模式识别等任务。此外,神经网络具有自适应能力,可以从错误中学习并随着时间推移不断改进。因此,它们能够更准确地处理人脸识别等复杂问题。

图 4。神经网络。
神经网络由多个并行工作的处理器组成,并按层进行组织。它们包括一个输入层、一个输出层,以及位于两者之间的多个隐藏层。输入层接收原始数据,就像我们的视神经接收视觉信息一样。
每一层都会将其输出传递给下一层,而不是直接处理原始输入,这类似于大脑中的神经元彼此传递信号。最后一层生成网络的输出。通过这一过程,人工神经网络 (ANN) 可以学习执行图像分类等计算机视觉任务。
神经网络在计算机视觉中的工业应用#
在了解神经网络是什么以及如何工作之后,让我们看看一个展示神经网络在计算机视觉领域潜力的应用。
能源行业的输电线路巡检#
神经网络构成了Ultralytics YOLO11等计算机视觉模型的基础,并可利用无人机对输电线路进行视觉巡检。公用事业行业在检查和维护庞大的输电线路网络时面临物流方面的挑战。这些线路通常从繁忙的城市区域延伸到偏远的崎岖地形。传统上,这些巡检由地面工作人员完成。虽然人工方法有效,但成本高、耗时长,还可能使工作人员暴露于环境和电气危险之中。研究表明,公用事业线路工作是美国十大最危险的工作之一,年死亡率为每 100,000 名工作人员中 30 至 50 人。
然而,无人机巡检技术可以让空中巡检成为更实用、更具成本效益的选择。前沿技术使无人机能够飞行更长距离,在巡检过程中无需频繁更换电池。如今,许多无人机已集成 AI,具备自动避障功能和更强的故障检测能力。这些功能使它们能够检查输电线路密集的区域,并从更远距离拍摄高质量图像。许多国家正在采用无人机和计算机视觉执行输电线路巡检任务。例如,在爱沙尼亚,100% 的输电线路巡检都由此类无人机完成。

图 5。技术人员使用无人机和 AI 工具检查输电线路(左图)以及他正在操作的无人机(右图)(suasnews)。
要点总结#
神经网络已经从研究走向实际应用,并成为现代技术进步的重要组成部分。它们让机器能够利用所学内容进行学习、识别模式并做出明智决策。从医疗保健和金融到自动驾驶汽车与制造业,这些网络正在推动创新并改变各个行业。随着我们不断探索和改进神经网络模型,它们重新定义我们日常生活和业务运营更多方面的潜力也日益清晰。
如需了解更多信息,请访问我们的 GitHub 代码库,并加入我们的社区。在我们的解决方案页面上探索制造业和农业中的 AI 应用。🚀









