Neural Network (NN)
探索神经网络的基础知识。学习它们如何驱动 AI,了解它们与深度学习的区别,以及它们如何推动诸如 Ultralytics YOLO26 之类的最先进模型。
神经网络 (NN) 是 人工智能 (AI) 核心的一种计算模型,旨在识别模式、解释感官数据以及聚类信息。受到人脑生物结构的启发,这些网络由相互连接的节点(即“神经元”)组成,并分层排列。生物大脑利用化学信号通过突触进行交流,而数字神经网络则利用数学运算来传输信息。这些系统是现代 机器学习 (ML) 背后的基础技术,使计算机能够在没有针对每个特定规则进行显式编程的情况下,解决识别人脸、翻译语言和驾驶自动驾驶汽车等复杂问题。
神经网络与深度学习#
虽然这些术语经常可以互换使用,但区分基本的神经网络与 深度学习 (DL) 非常重要。主要的区别在于深度和复杂度。标准或“浅层”神经网络在输入和输出之间可能只有一到两个隐藏层。相比之下,深度学习涉及具有数十甚至数百层的“深层”神经网络。这种深度使 特征提取 能够自动进行,从而允许模型理解分层模式——简单的边缘变成形状,形状变成可识别的物体。关于更深入的技术探讨,MIT News 解释了深度学习 及其从基础网络演变的过程。
神经网络如何学习#
神经网络中“学习”的过程涉及调整内部参数以最小化误差。数据通过输入层进入,穿过一个或多个进行计算的隐藏层,并最终通过输出层作为预测结果输出。
- 权重和偏置: 神经元之间的每个连接都有一个“权重”,用于决定信号的强度。在训练期间,网络会根据 训练数据 调整这些权重。
- 激活函数: 为了决定神经元是否应该“激发”或激活,网络使用诸如 ReLU 或 Sigmoid 等 激活函数。这引入了非线性,使网络能够学习复杂的边界。
- 反向传播: 当网络做出预测时,它会将结果与实际正确答案进行比较。如果存在误差,一种名为 反向传播 的算法会通过网络向后发送信号以微调权重,从而随着时间的推移提高准确率。
- 优化: 诸如 随机梯度下降 (SGD) 等算法有助于找到最佳权重组合以最小化损失函数。你可以阅读更多关于 AWS 上的优化算法 的信息。
实际应用#
神经网络是定义现代时代的许多技术背后的引擎。
-
计算机视觉: 在 计算机视觉 (CV) 领域,被称为 卷积神经网络 (CNN) 的专业网络用于分析视觉数据。诸如 Ultralytics YOLO26 的先进模型利用深层神经网络架构进行实时 目标检测。这些系统对于 农业人工智能(用于监测作物健康)以及用于异常检测的安全系统至关重要。
-
自然语言处理: 对于涉及文本的任务,诸如 循环神经网络 (RNN) 和 Transformer 的架构彻底改变了机器理解人类语言的方式。这些网络为 机器翻译 工具和虚拟助手提供动力。你可以在 医疗人工智能 中看到这些技术的影响,它们协助转录医疗记录并分析患者档案。
-
预测分析: 企业使用神经网络进行时间序列分析,以预测股价或库存需求。IBM 提供了关于 商业分析中的神经网络 的优秀概述。
实际实施#
现代软件库使得无需从头编写数学运算即可部署神经网络成为可能。诸如 Ultralytics Platform 等工具允许用户轻松在自定义数据集上训练这些网络。以下 Python 代码演示了如何加载预训练的神经网络(具体为最先进的 YOLO26 模型),并使用 ultralytics 包对图像运行推理。
from ultralytics import YOLO
# Load a pretrained YOLO26 neural network model
model = YOLO("yolo26n.pt")
# Run inference on an image to detect objects
# The model processes the image through its layers to predict bounding boxes
results = model("https://ultralytics.com/images/bus.jpg")
# Display the results
results[0].show()挑战与注意事项#
尽管功能强大,神经网络也带来了特定的挑战。它们通常需要大量标记数据来进行 监督学习。如果没有足够的数据多样性,网络很容易发生 过拟合,即它会死记硬背训练示例而不是学习泛化。此外,深层神经网络通常被称为“黑盒”,因为准确解释它们如何得出特定决策可能会很困难,这引发了对 可解释人工智能 (XAI) 的研究。IEEE 标准协会 等组织正积极致力于制定标准,以确保这些强大的网络得到合乎道德且安全的使用。






