Keypoints
Узнай, как ключевые точки (keypoints) определяют геометрию и позу объектов в ИИ. Исследуй оценку позы с Ultralytics YOLO26 и начни работу с нашим простым в использовании SDK на Python.
Ключевые точки — это определенные пространственные положения или ориентиры на изображении, которые определяют важные особенности объекта или субъекта. В контексте компьютерного зрения и машинного обучения ключевая точка обычно представляется набором координат (X, Y), которые точно указывают на определенную часть объекта, например, локоть человека, угол здания или центр автомобильного колеса. В отличие от более простых задач, которые только определяют присутствие объекта, определение ключевых точек позволяет моделям artificial intelligence (AI) понимать геометрию, позу и структурное расположение объекта. Эта способность лежит в основе расширенного визуального анализа, позволяя машинам интерпретировать язык тела, отслеживать точные движения и сопоставлять цифровые наложения с объектами реального мира.
Роль ключевых точек в моделях ИИ#
Ключевые точки служат базовыми данными для pose estimation, метода, который отображает скелетную структуру человека или животного. Обнаруживая предопределенный набор точек — таких как плечи, колени и лодыжки, — алгоритмы могут воссоздать полную позу субъекта в режиме реального времени. Этот процесс выходит за рамки стандартного object detection, который обычно выводит ограничивающую рамку вокруг объекта без учета его внутренней формы.
Современные архитектуры, такие как передовая Ultralytics YOLO26, эволюционировали, чтобы предсказывать эти ключевые точки с высокой точностью и скоростью. Эти модели используют сети deep learning (DL), обученные на массивно аннотированных наборах данных, таких как COCO Keypoints, чтобы изучать визуальные паттерны, связанные с суставами и чертами лица. Во время инференса модель регрессирует координаты для каждой ключевой точки, часто включая показатель уверенности для указания надежности предсказания.
Ключевые точки против схожих концепций#
Полезно отличать ключевые точки от других распространенных результатов компьютерного зрения, чтобы понять их уникальную полезность:
- Ключевые точки и ограничивающие рамки: Bounding box обеспечивает грубую локализацию, заключая весь объект в прямоугольник. Ключевые точки обеспечивают мелкозернистую локализацию конкретных частей внутри этого объекта.
- Ключевые точки и сегментация изображения: Image segmentation классифицирует каждый пиксель для создания точной маски формы объекта. Хотя сегментация предлагает подробную информацию о границах, ключевые точки предлагают структурную сводку («скелет»), которая часто более эффективна для анализа движения и kinematics.
- Ключевые точки и дескрипторы признаков: В традиционной обработке изображений, такой как SIFT (Scale-Invariant Feature Transform), ключевые точки являются точками интереса (углами, пятнами), используемыми для сопоставления изображений. В современном DL-оценивании поз ключевые точки являются семантическими метками (например, «левое запястье»), изучаемыми сетью.
Реальные приложения#
Способность отслеживать конкретные части тела или характеристики объектов открывает разнообразные возможности применения в различных отраслях:
- Спортивная аналитика: Тренеры и спортсмены используют оценку позы для анализа биомеханики. Отслеживая ключевые точки на суставах, системы могут вычислять углы и скорости для улучшения техники в таких видах спорта, как гольф, теннис или спринт. Посмотри, как Ultralytics YOLO models track golf swings для предоставления полезной обратной связи.
- Здравоохранение и реабилитация: Платформы физической терапии используют ключевые точки для удаленного контроля упражнений пациентов. Система гарантирует, что пациенты поддерживают правильную форму во время реабилитационных процедур, снижая риск травм и отслеживая прогресс восстановления.
- Дополненная реальность (AR): Фильтры в социальных сетях и приложения для виртуальной примерки полагаются на ключевые точки лица (контуры глаз, носа, рта), чтобы надежно закрепить цифровые маски или очки на лице пользователя, сохраняя выравнивание даже при движении.
- Мониторинг водителя: Автомобильные системы безопасности отслеживают ориентиры лица, чтобы обнаруживать признаки сонливости или отвлечения, предупреждая водителя, если его глаза закрыты или положение головы указывает на недостаток внимания.
Реализация детекции ключевых точек с помощью Ultralytics YOLO26#
Используя Ultralytics Platform или Python SDK, ты можешь легко реализовать обнаружение ключевых точек. Следующий пример демонстрирует, как загрузить предобученную YOLO26-pose model и запустить инференс на изображении для обнаружения человеческих скелетов.
from ultralytics import YOLO
# Load a pre-trained YOLO26 pose estimation model
model = YOLO("yolo26n-pose.pt")
# Run inference on an image
results = model("https://ultralytics.com/images/bus.jpg")
# Visualize the results showing detected keypoints and skeletons
for result in results:
result.show() # Display the image with keypoints drawn
# Access keypoint coordinates (x, y, confidence)
keypoints = result.keypoints.data
print(f"Detected keypoints shape: {keypoints.shape}")Этот простой рабочий процесс позволяет быстро развертывать сложные приложения computer vision (CV). Для пользователей, стремящихся обучить собственные пользовательские модели ключевых точек — например, для обнаружения определенных точек на промышленном оборудовании или видах животных, — Ultralytics Platform упрощает процесс разметки данных и обучения моделей в облаке.
Расширенные соображения#
Успешное развертывание обнаружения ключевых точек требует решения таких задач, как окклюзия (когда часть тела скрыта) и различные условия освещения. Современные модели решают эту проблему с помощью надежной data augmentation во время обучения, подвергая сеть воздействию разнообразных сценариев. Кроме того, интеграция ключевых точек с алгоритмами object tracking позволяет последовательно идентифицировать людей с течением времени в видеопотоках, что важно для таких приложений, как безопасность или поведенческий анализ.






