YOLO Vision 2026:

YOLOv10 против EfficientDet#

Выбор оптимальной нейронной сети для обнаружения объектов — это критически важное решение, которое определяет успех современных систем компьютерного зрения. Две выдающиеся архитектуры, значительно повлиявшие на эту область, — это YOLOv10 и EfficientDet. Хотя обе они стремятся максимизировать точность при минимизации вычислительных затрат, они используют совершенно разные архитектурные подходы для достижения этих целей.

Это подробное руководство погружает в их уникальные разработки, методологии обучения и характеристики развертывания, помогая разработчикам и инженерам по машинному обучению принимать решения на основе данных для приложений компьютерного зрения. Мы рассмотрим, как они работают на оборудовании — от встроенных краевых устройств ИИ до мощных облачных GPU.

YOLOv10: первопроходец без NMS#

Разработанная для раздвижения границ задержки в реальном времени, YOLOv10 решила одну из самых устойчивых проблем в семействе YOLO: подавление не максимумов (NMS). Устраняя этот этап постобработки, модель достигает высокой предсказуемости задержки, что критически важно для автономных транспортных средств и высокоскоростной робототехники.

Архитектурные инновации#

YOLOv10 вводит согласованные двойные назначения для обучения без NMS. В процессе обучения модель использует как назначения меток «один-ко-многим», так и «один-к-одному», что позволяет сети изучать богатые представления, при этом выдавая один лучший ограничивающий прямоугольник (bbox) для каждого объекта во время инференса. Архитектура также включает целостный дизайн, ориентированный на эффективность и точность, оптимизируя классификационную голову и уменьшая вычислительную избыточность, характерную для предыдущих версий.

Подробности о модели#

Упрощенное развертывание

Поскольку YOLOv10 исключает этап NMS, её по своей сути проще экспортировать в такие форматы, как формат ONNX и NVIDIA TensorRT, без необходимости использования пользовательских плагинов времени выполнения для фильтрации ограничивающих рамок.

Преимущества:

  • Предсказуемый инференс: Устранение NMS обеспечивает стабильное время инференса независимо от количества объектов в кадре.
  • Меньшее использование памяти: По сравнению с моделями на основе трансформеров, такими как RT-DETR, YOLOv10 требует значительно меньше памяти как во время обучения, так и при инференсе.
  • Отличное соотношение скорости и точности: Специально оптимизирована для сценариев с низкой задержкой без ущерба для метрик производительности.

Недостатки:

Узнай больше о YOLOv10

EfficientDet: масштабируемость и баланс#

Представленная Google Brain, модель EfficientDet подходит к обнаружению объектов через призму систематического масштабирования сети. Она построена на основе бэкенда EfficientNet для классификации изображений и вводит новый механизм слияния признаков.

Архитектурные инновации#

Основой EfficientDet является Bi-directional Feature Pyramid Network (BiFPN), которая обеспечивает простое и быстрое многомасштабное слияние признаков. В отличие от традиционных FPN, которые суммируют признаки только сверху вниз, BiFPN вводит двунаправленные кросс-масштабные соединения и обучаемые веса для оценки важности различных входных признаков. Кроме того, EfficientDet использует метод составного масштабирования, который равномерно масштабирует разрешение, глубину и ширину для всех сетей — бэкенда, сети признаков и сетей предсказания bbox/классов.

Подробности о модели#

Преимущества:

  • Высокая эффективность: Отличное соотношение параметров и точности, благодаря которому меньшие варианты -d0 и -d2 являются очень легковесными.
  • Принципиальное масштабирование: Составное масштабирование позволяет легко выбирать размер модели, соответствующий твоему вычислительному бюджету.

Недостатки:

  • Интеграция с устаревшими фреймворками: Оригинальная реализация сильно зависит от старых версий TensorFlow, что может усложнять современные конвейеры развертывания.
  • Более медленное обучение: Обучение EfficientDet «с нуля» крайне медленное и требует тщательной настройки гиперпараметров по сравнению с быстрой сходимостью архитектур YOLO.
  • Скорость инференса: Несмотря на эффективность по параметрам, сложные операции BiFPN часто приводят к более медленной скорости инференса в реальных условиях на стандартном оборудовании по сравнению с высокооптимизированными моделями YOLO.

Узнай больше об EfficientDet

Производительность и бенчмарки#

Истинная проверка этих моделей заключается в их эмпирической производительности на стандартных бенчмарках, таких как датасет COCO. Таблица ниже иллюстрирует критические различия в количестве параметров, количестве операций с плавающей точкой (FLOPs) и задержке инференса на GPU NVIDIA T4.

Модельразмер
(пиксели)
mAPval
50-95
Скорость
CPU ONNX
(мс)
Скорость
T4 TensorRT10
(мс)
параметры
(М)
FLOPs
(Б)
YOLOv10n64039.5-1.562.36.7
YOLOv10s64046.7-2.667.221.6
YOLOv10m64051.3-5.4815.459.1
YOLOv10b64052.7-6.5424.492.0
YOLOv10l64053.3-8.3329.5120.3
YOLOv10x64054.4-12.256.9160.4
EfficientDet-d064034.610.23.923.92.54
EfficientDet-d164040.513.57.316.66.1
EfficientDet-d264043.017.710.928.111.0
EfficientDet-d364047.528.019.5912.024.9
EfficientDet-d464049.742.833.5520.755.2
EfficientDet-d564051.572.567.8633.7130.0
EfficientDet-d664052.692.889.2951.9226.0
EfficientDet-d764053.7122.0128.0751.9325.0

Как показано выше, YOLOv10 сохраняет значительное преимущество в «чистой» скорости инференса. Например, YOLOv10-S достигает 46.7 mAP при задержке TensorRT всего 2.66 мс, тогда как EfficientDet-d3 достигает схожих 47.5 mAP, но затрачивает почти 20 мс, что делает YOLOv10 значительно более подходящей для потокового видео в реальном времени или скоростных производственных конвейеров.

Сценарии использования и рекомендации#

Выбор между YOLOv10 и EfficientDet зависит от твоих конкретных требований к проекту, ограничений при развертывании и предпочтений в экосистеме.

Когда стоит выбрать YOLOv10#

YOLOv10 — отличный выбор для:

  • Детекции в реальном времени без NMS: Приложения, которым полезна сквозная (end-to-end) детекция без использования Non-Maximum Suppression, что снижает сложность развертывания.
  • Сбалансированного соотношения скорости и точности: Проекты, требующие оптимального баланса между скоростью вывода и точностью детекции для различных масштабов моделей.
  • Приложения с постоянной задержкой: Сценарии развертывания, где предсказуемое время вывода критически важно, например, в robotics или автономных системах.

Когда стоит выбрать EfficientDet#

EfficientDet рекомендуется для:

  • Конвейеры Google Cloud и TPU: Системы с глубокой интеграцией в Google Cloud Vision API или инфраструктуру TPU, где EfficientDet имеет встроенную оптимизацию.
  • Исследования составного масштабирования: Академическое тестирование, сфокусированное на изучении эффектов сбалансированного масштабирования глубины, ширины и разрешения сети.
  • Мобильное развертывание через TFLite: Проекты, которым специально требуется экспорт TensorFlow Lite для Android или встраиваемых устройств Linux.

Когда выбирать Ultralytics (YOLO26)#

Для большинства новых проектов Ultralytics YOLO26 предлагает наилучшее сочетание производительности и удобства для разработчика:

  • Развертывания на периферии без NMS: приложений, требующих стабильного вывода с низкой задержкой без сложности постобработки подавления немаксимумов.
  • Среды только с CPU: устройств без выделенного GPU-ускорения, где до 43% более быстрый вывод на CPU у YOLO26 дает решающее преимущество.
  • Обнаружение малых объектов: Сложные сценарии, такие как aerial drone imagery или анализ с помощью IoT-сенсоров, где ProgLoss и STAL значительно повышают точность для крошечных объектов.

Современный стандарт: встречай Ultralytics YOLO26#

Хотя YOLOv10 представила новаторскую парадигму без NMS, а EfficientDet продемонстрировала принципиальное масштабирование, сфера компьютерного зрения продолжает развиваться. Для разработчиков, начинающих новые проекты сегодня, Ultralytics YOLO26 представляет собой бесспорный передовой уровень технологий. Выпущенная в январе 2026 года, она объединяет лучшее из всех миров в высококачественный, готовый к производству пакет в рамках платформы Ultralytics.

Почему YOLO26 превосходит конкурентов#

  1. End-to-End дизайн без NMS: YOLO26 нативно использует архитектуру без NMS, впервые предложенную в YOLOv10, упрощая развертывание и ускоряя инференс.
  2. До 43% быстрее инференс на CPU: Для устройств, где нет специализированных ускорителей, YOLO26 специально оптимизирована для эффективной работы на стандартных CPU.
  3. Продвинутый оптимизатор MuSGD: Вдохновленный инновациями в обучении языковых моделей, YOLO26 использует гибрид SGD и Muon для невероятно стабильного обучения и быстрой сходимости, значительно улучшая эффективность обучения по сравнению с EfficientDet.
  4. ProgLoss + STAL: Эти улучшенные функции потерь обеспечивают значительный прирост в распознавании мелких объектов, что было традиционно слабым местом как для YOLOv10, так и для EfficientDet.
  5. Удаление DFL: Благодаря удалению функции потерь распределения (Distribution Focal Loss), YOLO26 легко экспортируется практически в любой формат оборудования, включая OpenVINO и CoreML.

Кроме того, YOLO26 обеспечивает непревзойденную универсальность. В то время как EfficientDet и YOLOv10 являются строго моделями обнаружения, YOLO26 легко справляется с ориентированными ограничивающими рамками, классификацией изображений и сегментацией экземпляров с использованием того же интуитивно понятного пакета Python от Ultralytics.

Хорошо поддерживаемая экосистема

И YOLO11, и YOLOv8 остаются полностью поддерживаемыми в экосистеме Ultralytics. Для наилучшего сочетания производительности, стабильности и долгосрочной поддержки мы рекомендуем использовать официально поддерживаемые модели Ultralytics.

Простота использования с Ultralytics#

Хорошо поддерживаемая экосистема, предоставляемая Ultralytics, обеспечивает удобство для разработчиков. Обучение модели, ее валидация и экспорт для интеграции с TensorRT занимают всего несколько строк кода.

from ultralytics import YOLO

# Load a pre-trained YOLOv10 model (or upgrade to YOLO26 natively)
model = YOLO("yolov10n.pt")

# Train the model efficiently on a custom dataset
model.train(data="coco8.yaml", epochs=50, imgsz=640)

# Run inference and immediately visualize results
results = model("https://ultralytics.com/images/bus.jpg")
results[0].show()

# Export for rapid deployment
model.export(format="engine", quantize=16)

Заключение#

При сравнении YOLOv10 и EfficientDet выбор сильно зависит от предпочтений в фреймворке и ограничений по скорости. EfficientDet предлагает структурированный подход к масштабированию моделей в экосистеме TensorFlow. Однако YOLOv10 обеспечивает превосходную производительность в реальном времени, меньшее использование памяти и более простой путь развертывания благодаря своей архитектуре без NMS.

Для достижения наилучшего баланса производительности, простоты использования и универсальности для решения нескольких задач настоятельно рекомендуется перейти на платформу Ultralytics и использовать YOLO26. Она перенимает инновации YOLOv10 без NMS, применяет современные методы обучения, такие как оптимизатор MuSGD, и упаковывает все это в надежный открытый фреймворк, поддерживаемый огромным глобальным сообществом.

Комментарии