Ultralytics YOLO27:

YOLOv10 与 YOLOv5#

选择合适的神经网络架构对于在生产环境中成功部署计算机视觉流水线至关重要。本页面对 YOLOv10YOLOv5 进行了深入的技术分析,这两个模型在实时目标检测的发展过程中都具有重要影响。虽然这两个模型都对 AI 社区产生了重大影响,但它们代表了深度学习架构设计中不同时代和不同理念。

本指南将根据平均精度 (mAP)、推理延迟、参数效率和生态系统支持对这些架构进行评估,帮助你选择最符合部署需求的模型。

模型概览#

YOLOv10:实时端到端目标检测#

YOLOv10 由清华大学的研究人员开发,通过消除对后处理的需求,为目标检测引入了一种新方法。

YOLOv10 的标志性突破是其端到端无 NMS 设计。从历史上看,YOLO 模型依赖非极大值抑制 (NMS)来过滤冗余边界框。YOLOv10 采用一致的双重分配进行无 NMS 训练,大幅降低了推理延迟的波动,并简化了部署逻辑。此外,该架构采用整体性的效率—精度驱动设计,对各个组件进行了全面优化,以减少计算冗余。

了解更多关于 YOLOv10 的信息

YOLOv5:易用性的行业标准#

YOLOv5 在 Ultralytics PyTorch 仓库创建后不久发布,重新定义了开发者对开源视觉 AI 框架的期待。时至今日,它仍然是全球部署最广泛的架构之一。

YOLOv5 以其易用性和高度维护完善的生态系统而广受认可。它完全使用 PyTorch 编写,为训练、验证以及导出为 ONNXTensorRT 等格式提供开箱即用的支持,实现了顺畅的“从零到高手”体验。与主要专注于纯目标检测的 YOLOv10 不同,YOLOv5 展现出卓越的多功能性,可在统一的 Python API 中支持实例分割图像分类

性能与指标对比#

可视化速度与精度之间的关系,对于识别在给定速度限制下能够提供最佳精度的模型至关重要。理解这些性能指标是选择符合特定硬件限制的模型的基础。

模型尺寸
(像素)
mAPval
50-95
速度
CPU ONNX
(毫秒)
速度
T4 TensorRT10
(毫秒)
参数量
(M)
FLOPs
(B)
YOLOv10n64039.5-1.562.36.7
YOLOv10s64046.7-2.667.221.6
YOLOv10m64051.3-5.4815.459.1
YOLOv10b64052.7-6.5424.492.0
YOLOv10l64053.3-8.3329.5120.3
YOLOv10x64054.4-12.256.9160.4
YOLOv5n64028.073.61.122.67.7
YOLOv5s64037.4120.71.929.124.0
YOLOv5m64045.4233.94.0325.164.2
YOLOv5l64049.0408.46.6153.2135.0
YOLOv5x64050.7763.211.8997.2246.4

技术分析#

  1. 精度 (mAP): YOLOv10 在精度方面展现出明显的代际优势。例如,YOLOv10-X 模型达到 54.4% mAPval,超过 YOLOv5x 的 50.7% mAP。这一跃升主要得益于无 NMS 训练策略以及 2024 年引入的架构改进。
  2. 推理延迟: 虽然 YOLOv5 模型在原始 T4 TensorRT 基准测试中速度极快(例如 YOLOv5n 仅需 1.12ms),但 YOLOv10 完全消除了后处理 NMS 步骤。在端到端的实际部署中,YOLOv10 的无 NMS 设计能够提供更加一致且确定性的延迟,这对于自动驾驶车辆和机器人等实时应用至关重要。
  3. 参数效率: YOLOv10 模型保持了极具竞争力的性能平衡。YOLOv10-S 仅使用 720 万个参数即可达到 46.7% mAP,而 YOLOv5s 使用 910 万个参数时达到 37.4% mAP。
部署提示

将模型部署到边缘 AI设备(例如 NVIDIA Jetson)时,不包含 NMS 逻辑的模型(如 YOLOv10 和 YOLO26)通常能够更顺利地编译为 TensorRT,从而避免回退到 CPU 执行相关操作。

使用场景与建议#

在 YOLOv10 和 YOLOv5 之间进行选择,取决于你的具体项目需求、部署限制和生态系统偏好。

何时选择 YOLOv10#

YOLOv10 适合:

  • 无 NMS 实时检测: 适用于能够从无需非极大值抑制的端到端检测中受益的应用,可降低部署复杂性。
  • 速度与准确率的平衡: 适用于需要在各种模型规模之间实现推理速度和检测准确率良好平衡的项目。
  • 延迟稳定的应用: 适用于推理时间可预测至关重要的部署场景,例如机器人技术或自主系统。

何时选择 YOLOv5#

推荐在以下情况下使用 YOLOv5:

  • 经过生产验证的系统: 重视 YOLOv5 长期稳定记录、完善文档和庞大社区支持的现有部署项目。
  • 资源受限的训练: GPU 资源有限的环境,此时 YOLOv5 高效的训练流水线和较低的内存需求更具优势。
  • 广泛的导出格式支持: 需要跨多种格式部署的项目,包括 ONNXTensorRTCoreMLTFLite

何时选择 Ultralytics (YOLO26)#

对于大多数新项目,Ultralytics YOLO26 在性能和开发者体验之间提供了最佳组合:

  • 无 NMS 边缘部署: 适用于需要稳定、低延迟推理,同时又不希望引入非极大值抑制后处理复杂性的应用。
  • 仅使用 CPU 的环境: 适用于没有专用 GPU 加速的设备,此时 YOLO26 最高提升 43% 的 CPU 推理速度将带来决定性优势。
  • 小目标检测: 适用于航空无人机影像或 IoT 传感器分析等具有挑战性的场景,在这些场景中,ProgLoss 和 STAL 能显著提升微小目标的准确率。

Ultralytics 的优势#

虽然 YOLOv10 提供出色的检测能力,但依赖学术代码仓库有时会使生产流水线变得复杂。使用官方 Ultralytics Python 软件包,你可以获得一个统一的生态系统,同时支持 YOLOv5 和 YOLOv10 以及高级功能。

  • 训练效率: Ultralytics YOLO 架构针对训练期间较低的内存需求进行了深度优化。与需要大量 CUDA 内存的重型 Transformer 模型(如 RT-DETR)不同,你可以在标准消费级 GPU 上轻松训练 YOLOv5 和 YOLOv10。
  • 生态系统集成:Ultralytics Platform 的集成让开发者能够直观地管理数据集、使用 Weights & Biases跟踪实验,并自动调优超参数。

代码示例:无缝训练#

使用 Ultralytics 库时,只需更改模型字符串即可在这些架构之间切换。训练流水线会自动处理数据增强、缩放和优化器配置。

from ultralytics import YOLO

# To use YOLOv5:
# model = YOLO("yolov5s.pt")

# To use YOLOv10:
model = YOLO("yolov10s.pt")

# Train the model on a custom dataset
results = model.train(
    data="coco8.yaml",
    epochs=100,
    imgsz=640,
    batch=16,
    device=0,  # Use GPU 0
)

# Export the trained model to ONNX format
path = model.export(format="onnx")

新一代:Ultralytics YOLO26#

如果你今天要开始一个新的机器学习项目,我们强烈建议你评估最新的 Ultralytics YOLO26。它于 2026 年 1 月发布,通过融合过去五年的最佳创新,代表了绝对的业界最先进水平。

YOLO26 原生集成了由 YOLOv10 首创的端到端无 NMS 设计,确保快速且确定性的部署。此外,YOLO26 还引入了几项关键突破:

  • CPU 推理速度最高提升 43%: 通过移除分布式焦点损失 (DFL) 模块,YOLO26 在标准 CPU 上实现了大幅加速,成为移动端部署和低功耗 IoT 传感器的首选。
  • MuSGD 优化器: YOLO26 受到 Moonshot AI 的 Kimi K2 等大型语言模型 (LLM) 训练技术的启发,采用 SGD 和 Muon 的混合方案。与 YOLOv10 使用的 AdamW 优化器相比,这能确保训练过程极其稳定,并显著加快收敛速度。
  • ProgLoss + STAL: 这些高级损失函数能够显著提升小目标识别效果,这对于无人机图像和空中安防应用至关重要。
  • 任务专用能力: YOLOv10 严格来说是边界框检测器,而 YOLO26 则针对所有任务提供专门的架构改进,包括用于姿态估计的残差对数似然估计 (RLE) 以及用于定向边界框 (OBB) 的专用角度损失。
进一步探索

如果你正在探索更广泛的目标检测领域,可能也会对将这些架构与其他框架进行比较感兴趣。查看我们关于 YOLO11 与 EfficientDet 对比RT-DETR 与 YOLOv8 对比的深度分析,了解更全面的基准测试。

无论你依赖的是 YOLOv5 稳健的历史积累、YOLOv10 的无 NMS 创新,还是 YOLO26 无与伦比的前沿性能,Ultralytics 生态系统都能提供必要的工具,帮助你快速高效地将视觉 AI 应用变为现实。

评论