Neural Network (NN)
Исследуй основы нейронных сетей. Узнай, как они обеспечивают работу ИИ, чем отличаются от глубокого обучения и как лежат в основе передовых моделей, таких как Ultralytics YOLO26.
Нейронная сеть (NN) — это вычислительная модель, лежащая в основе искусственного интеллекта (AI) и предназначенная для распознавания образов, интерпретации сенсорных данных и кластеризации информации. Вдохновленные биологической структурой человеческого мозга, эти сети состоят из соединенных между собой узлов, или «нейронов», организованных в слои. Если биологический мозг использует химические сигналы для связи через синапсы, то цифровая нейронная сеть использует математические операции для передачи информации. Эти системы являются основополагающей технологией современного машинного обучения (ML), позволяющей компьютерам решать сложные задачи, такие как распознавание лиц, перевод языков и вождение автономных транспортных средств без явного программирования для каждого конкретного правила.
Нейронные сети против глубокого обучения#
Хотя эти термины часто используются как взаимозаменяемые, важно различать базовую нейронную сеть и глубокое обучение (DL). Основное различие заключается в глубине и сложности. Стандартная или «мелкая» нейронная сеть может иметь всего один или два скрытых слоя между входом и выходом. В отличие от этого, глубокое обучение включает в себя «глубокие» нейронные сети с десятками или даже сотнями слоев. Эта глубина позволяет извлечению признаков происходить автоматически, позволяя модели понимать иерархические закономерности: простые грани становятся формами, а формы становятся узнаваемыми объектами. Для более глубокого технического погружения MIT News объясняет глубокое обучение и его эволюцию от базовых сетей.
Как обучаются нейронные сети#
Процесс «обучения» в нейронной сети включает настройку внутренних параметров для минимизации ошибок. Данные поступают через входной слой, проходят через один или несколько скрытых слоев, где выполняются вычисления, и выходят через выходной слой в виде прогноза.
- Веса и смещения: Каждое соединение между нейронами имеет «вес», который определяет силу сигнала. Во время обучения сеть корректирует эти веса на основе обучающих данных.
- Функции активации: Чтобы решить, должен ли нейрон «срабатывать» или активироваться, сеть использует функцию активации, такую как ReLU или Sigmoid. Это вносит нелинейность, позволяя сети изучать сложные границы.
- Обратное распространение: Когда сеть делает предсказание, она сравнивает результат с фактическим правильным ответом. Если возникает ошибка, алгоритм под названием обратное распространение отправляет сигнал назад через сеть для точной настройки весов, повышая точность с течением времени.
- Оптимизация: Алгоритмы, такие как стохастический градиентный спуск (SGD), помогают найти оптимальный набор весов для минимизации функции потерь. Ты можешь прочитать больше об алгоритмах оптимизации на AWS.
Реальные приложения#
Нейронные сети — это двигатели многих технологий, определяющих современную эпоху.
-
Компьютерное зрение: В области компьютерного зрения (CV) специализированные сети, называемые сверточными нейронными сетями (CNN), используются для анализа визуальных данных. Передовые модели, такие как Ultralytics YOLO26, используют архитектуры глубоких нейронных сетей для обнаружения объектов в реальном времени. Эти системы имеют решающее значение для ИИ в сельском хозяйстве, где они следят за здоровьем сельскохозяйственных культур, а также в системах безопасности для обнаружения аномалий.
-
Обработка естественного языка: Для задач, связанных с текстом, такие архитектуры, как рекуррентные нейронные сети (RNN) и Transformers, произвели революцию в том, как машины понимают человеческий язык. Эти сети питают инструменты машинного перевода и виртуальных помощников. Ты можешь увидеть влияние этих технологий в ИИ в здравоохранении, где они помогают расшифровывать медицинские заметки и анализировать записи пациентов.
-
Предиктивная аналитика: Предприятия используют нейронные сети для анализа временных рядов для прогнозирования цен акций или потребностей в запасах. IBM предоставляет отличный обзор нейронных сетей в бизнес-аналитике.
Практическая реализация#
Современные программные библиотеки делают развертывание нейронных сетей доступным без необходимости писать математические операции с нуля. Такие инструменты, как Ultralytics Platform, позволяют пользователям легко обучать эти сети на пользовательских наборах данных. Следующий код на Python демонстрирует, как загрузить предобученную нейронную сеть (а именно современную модель YOLO26) и запустить инференс на изображении с помощью пакета ultralytics.
from ultralytics import YOLO
# Load a pretrained YOLO26 neural network model
model = YOLO("yolo26n.pt")
# Run inference on an image to detect objects
# The model processes the image through its layers to predict bounding boxes
results = model("https://ultralytics.com/images/bus.jpg")
# Display the results
results[0].show()Проблемы и соображения#
Будучи мощными, нейронные сети представляют определенные проблемы. Обычно они требуют большого количества размеченных данных для обучения с учителем. Без достаточного разнообразия данных сеть склонна к переобучению, при котором она запоминает примеры обучения, а не учится обобщать. Кроме того, глубокие нейронные сети часто называют «черными ящиками», потому что интерпретировать то, как именно они пришли к конкретному решению, может быть трудно, что вызывает исследования в области объяснимого искусственного интеллекта (XAI). Такие организации, как IEEE Standards Association, активно работают над стандартами, гарантирующими, что эти мощные сети используются этично и безопасно.






