Neural Network (NN)
探索神经网络基础。了解它们如何驱动 AI、与深度学习有何不同,以及如何推动 Ultralytics YOLO26 等先进模型的发展。
神经网络 (NN) 是一种计算模型,位于人工智能 (AI)的核心,旨在识别模式、解读感知数据并对信息进行聚类。这些网络受到人类大脑生物结构的启发,由相互连接的节点(即“神经元”)组成,并按层组织。生物大脑通过化学信号在突触之间进行通信,而数字神经网络则通过数学运算传递信息。这些系统是现代机器学习 (ML)背后的基础技术,使计算机无需针对每条具体规则进行明确编程,就能解决人脸识别、语言翻译和自动驾驶等复杂问题。
神经网络与深度学习#
虽然这两个术语经常互换使用,但区分基础神经网络和深度学习 (DL)非常重要。主要区别在于深度和复杂性。标准的或“浅层”神经网络在输入层和输出层之间可能只有一到两个隐藏层。相比之下,深度学习使用具有“深层”结构的神经网络,包含几十层甚至数百层。这种深度使特征提取能够自动进行,让模型理解层次化模式——简单的边缘组合成形状,形状再组合成可识别的物体。如需更深入的技术介绍,请参阅MIT News 对深度学习的解释及其从基础网络发展而来的历程。
神经网络如何学习#
神经网络中的“学习”过程包括调整内部参数以最小化误差。数据通过输入层进入,经过一个或多个进行计算的隐藏层,最后以预测结果的形式从输出层离开。
- 权重和偏置: 神经元之间的每条连接都有一个“权重”,用于决定信号的强度。在训练过程中,网络会根据训练数据调整这些权重。
- 激活函数: 为了决定神经元是否应当“放电”或激活,网络会使用 ReLU 或 Sigmoid 等激活函数。这会引入非线性,使网络能够学习复杂的边界。
- 反向传播: 网络进行预测后,会将结果与实际正确答案进行比较。如果存在误差,一种称为反向传播的算法会通过网络向后发送信号,以微调权重,随着时间推移提高准确率。
- 优化: 随机梯度下降 (SGD)等算法有助于找到能够最小化损失函数的最优权重组合。你可以阅读AWS 上关于优化算法的更多内容。
实际应用#
神经网络是许多定义现代时代的技术背后的引擎。
-
计算机视觉: 在计算机视觉 (CV)领域,称为卷积神经网络 (CNNs)的专用网络用于分析视觉数据。先进模型如Ultralytics YOLO26采用深度神经网络架构进行实时目标检测。这些系统对农业中的 AI至关重要,可用于监测作物健康状况,也用于安全系统中的异常检测。
-
自然语言处理: 对于涉及文本的任务,循环神经网络 (RNNs)和Transformer等架构彻底改变了机器理解人类语言的方式。这些网络为机器翻译工具和虚拟助手提供支持。你可以在医疗保健中的 AI领域看到这些技术的影响,它们可协助转录医疗笔记并分析患者记录。
-
预测分析: 企业使用神经网络进行时间序列分析,以预测股票价格或库存需求。IBM 对神经网络在业务分析中的应用进行了出色的概述。
实际实现#
现代软件库让部署神经网络变得更加容易,无需从头编写数学运算。Ultralytics Platform等工具可以让用户轻松使用自定义数据集训练这些网络。以下 Python 代码演示了如何加载一个预训练神经网络(具体来说是先进的 YOLO26 模型),并使用 ultralytics 软件包对图像运行推理。
from ultralytics import YOLO
# Load a pretrained YOLO26 neural network model
model = YOLO("yolo26n.pt")
# Run inference on an image to detect objects
# The model processes the image through its layers to predict bounding boxes
results = model("https://ultralytics.com/images/bus.jpg")
# Display the results
results[0].show()挑战与注意事项#
神经网络虽然功能强大,但也面临特定挑战。它们通常需要大量带标注的数据来进行监督学习。如果数据多样性不足,网络就容易过拟合,即记住训练样本,而不是学会泛化。此外,深度神经网络通常被称为“黑盒”,因为很难准确解释它们是如何得出某个具体决策的,这推动了对可解释人工智能 (XAI)的研究。IEEE 标准协会等组织正在积极制定标准,以确保这些强大的网络得到合乎伦理且安全的使用。









