Ultralytics YOLO27:

YOLOX 与 YOLO26#

过去十年间,计算机视觉领域经历了令人瞩目的变革。其中两个重要里程碑分别是 YOLOX 的发布(它推动了无锚框架构的普及)以及近期推出的 Ultralytics YOLO26(凭借原生端到端、无需 NMS 的设计,彻底重新定义了实时性能)。这份全面的对比将探讨它们的架构、性能指标和理想部署场景,帮助开发者为下一个 AI 项目做出明智决策。

模型概览#

了解每个模型的起源和主要设计目标,有助于深入理解它们各自取得的技术成果。

YOLOX#

YOLOX 于 2021 年年中推出,通过采用无锚设计、解耦头以及名为 SimOTA 的先进标签分配策略,实现了重大转变。YOLOX 摆脱了以往架构中占主导地位的传统锚框机制,成功弥合了学术研究与工业应用之间的差距,为目标检测提供了简洁而高效的框架。

了解有关 YOLOX 的更多信息

YOLO26#

YOLO26 于 2026 年初发布,是多年迭代改进的成果,重点关注边缘部署和简化训练流程。它引入了端到端、无需 NMS 的设计,彻底消除了传统的非极大值抑制后处理步骤。这一突破大幅简化了模型在各种硬件上的部署。此外,通过移除 Distribution Focal Loss(DFL)模块,YOLO26 实现了显著更低的延迟,巩固了其作为现代计算机视觉应用首选方案的地位。

架构创新#

这两个模型的架构凸显了深度学习方法的快速发展,尤其是在损失函数和后处理方面。

YOLOX 方案#

YOLOX 在其预测头中将分类任务与回归任务解耦,从而显著加快了训练期间的收敛速度。其无锚特性减少了设计参数的数量,降低了训练前进行复杂锚框调优的需求。结合 SimOTA 标签分配算法,YOLOX 在当时取得了最先进的结果,尤其是在 COCO 数据集等标准基准上。

YOLO26 的优势#

YOLO26 将架构效率提升到了新的层次。移除 NMS 不仅降低了推理延迟,还确保了执行时间的一致性和确定性——这对自动驾驶车辆和机器人技术至关重要。

YOLO26 的主要创新包括:

  • **MuSGD 优化器:**受大型语言模型(LLM)训练技术启发,这种 SGD 与 Muon 的混合优化器能够确保训练过程极其稳定,并实现更快收敛。
  • **CPU 推理速度最高提升 43%:**通过消除 DFL 并精简网络架构,YOLO26 针对资源受限的边缘设备进行了深度优化,适用于从简单的 IoT 传感器到 Raspberry Pi 开发板等设备。
  • **ProgLoss + STAL:**这些先进的损失函数显著提升了小目标识别能力,这对于分析航空影像以及在制造自动化中执行精确质量控制至关重要。
边缘优先优化

如果你的项目面向没有专用 GPU 的嵌入式系统或移动应用,YOLO26 优化后的 CPU 性能将带来巨大优势,相比早期模型,它所需的计算开销显著更低。

性能与基准测试#

在为生产环境评估模型时,分析精度、速度和计算复杂度之间的平衡至关重要。下面详细比较了在图像尺寸为 640 像素(nano/tiny 变体为 416 像素)下评估的标准模型。

模型尺寸
(像素)
mAPval
50-95
速度
CPU ONNX
(毫秒)
速度
T4 TensorRT10
(毫秒)
参数量
(M)
FLOPs
(B)
YOLOXnano41625.8--0.911.08
YOLOXtiny41632.8--5.066.45
YOLOXs64040.5-2.569.026.8
YOLOXm64046.9-5.4325.373.8
YOLOXl64049.7-9.0454.2155.6
YOLOXx64051.1-16.199.1281.9
YOLO26n64040.938.91.72.45.4
YOLO26s64048.687.22.59.520.7
YOLO26m64053.1220.04.720.468.2
YOLO26l64055.0286.26.224.886.4
YOLO26x64057.5525.811.855.7193.9

如表格所示,YOLO26 系列提供了更优的性能平衡。例如,YOLO26x 在使用的参数量仅为 YOLOXx 模型近一半的情况下,仍实现了令人印象深刻的 57.5 mAP,直接带来了更快的 GPU 推理速度(11.8 ms 对比 16.1 ms)以及显著更出色的部署灵活性。

训练与生态系统体验#

这两种架构最显著的差异之一在于易用性和生态系统支持。

虽然 YOLOX 仍是研究梯度流和无锚机制的研究人员所依赖的基础代码库,但其设置过程可能较为复杂,通常需要手动配置依赖项和算子。相比之下,**Ultralytics 生态系统**定义了行业易用性标准。

借助统一的 Python API,开发者可以极其简单地初始化、训练和部署 YOLO26 模型。该系统能够自动处理数据集下载、超参数调优,以及无缝导出为 ONNXTensorRT 和 OpenVINO 等格式。

from ultralytics import YOLO

# Initialize the cutting-edge, end-to-end YOLO26 small model
model = YOLO("yolo26s.pt")

# Train the model efficiently with built-in MuSGD optimization
results = model.train(data="coco8.yaml", epochs=100, imgsz=640)

# Validate the model's performance on the validation set
metrics = model.val()

# Export the optimized model for edge deployment
model.export(format="onnx")

此外,与基于大型 Transformer 的替代方案相比,Ultralytics YOLO 模型在训练期间所需的内存显著更少,使工程师即使使用消费级硬件,也能训练更大的批次大小。

实际应用#

最终选择 YOLOX 还是 YOLO26,取决于你的部署限制和多任务需求。

YOLOX 的优势场景#

对于特定的学术基准和深度集成 MegEngine 框架的遗留系统,YOLOX 仍是可行的候选方案。凭借其历史意义,它成为研究无锚检测器和自定义分配策略的热门基线。

YOLO26 的优势领域#

YOLO26 从根本上就是为现代工业应用而设计的。由于它原生支持实例分割姿态估计旋转边界框(OBB),因此比标准检测引擎更加灵活。

  • **智能零售与库存:**利用无需 NMS 的设计,自动结账系统能够以极低延迟处理视频流,在没有后处理循环瓶颈的情况下识别商品。
  • **无人机与航空分析:**针对 OBB 的专用角度损失以及 ProgLoss + STAL 的集成,使 YOLO26 在广阔卫星图像中检测旋转目标和微小伪影方面无可匹敌。
  • **边缘安全系统:**凭借快 43% 的 CPU 推理速度,YOLO26 使企业能够将强大的安全分析功能直接部署到价格低廉的本地硬件上,而无需昂贵的云计算资源。

使用场景与建议#

选择 YOLOX 还是 YOLO26,取决于你的具体项目需求、部署限制和生态系统偏好。

何时选择 YOLOX#

YOLOX 适合以下场景:

  • 无锚框检测研究: 使用 YOLOX 简洁的无锚框架构作为基线,试验新的检测头或损失函数的学术研究。
  • 超轻量级边缘设备: 部署到微控制器或传统移动硬件上时,YOLOX-Nano 变体极小的体积(0.91M 个参数)至关重要。
  • SimOTA 标签分配研究: 研究基于最优传输的标签分配策略及其对训练收敛影响的项目。

何时选择 YOLO26#

推荐使用 YOLO26 的场景:

  • 无 NMS 边缘部署: 适用于需要稳定、低延迟推理,同时又不希望引入非极大值抑制后处理复杂性的应用。
  • 仅使用 CPU 的环境: 适用于没有专用 GPU 加速的设备,此时 YOLO26 最高提升 43% 的 CPU 推理速度将带来决定性优势。
  • 小目标检测: 适用于航空无人机影像或 IoT 传感器分析等具有挑战性的场景,在这些场景中,ProgLoss 和 STAL 能显著提升微小目标的准确率。

探索其他 Ultralytics 模型#

如果你正在探索计算机视觉的发展历程,Ultralytics 系列中还有其他值得研究的高性能模型:

  • **YOLO11:**YOLO26 的直接前代模型,在稳定的生产环境中提供可靠性能和广泛的社区支持。
  • **YOLOv8:**经过大量实际验证的架构,在数千个真实部署中树立了易用性和灵活性的标准。

总之,YOLOX 为目标检测领域引入了关键概念,而全新的 YOLO26 在速度、精度和部署简便性方面实现了跨代跃升,使其成为具有前瞻性的开发者和企业的明确选择。

评论