YOLO26 与 YOLO11 对比#
在构建最先进的计算机视觉系统时,选择正确的模型对于平衡准确性、延迟和资源效率至关重要。在快速发展的人工智能领域,Ultralytics 不断突破可能性的边界。这份详细的技术比较探讨了从广受成功的 YOLO11 到革命性的新一代 YOLO26 的演进,为 AI 工程师和研究人员提供了做出明智架构决策所需的见解。
模型传承与元数据#
这两个模型均由 Ultralytics 开发,但它们代表了目标检测和多任务视觉模型发展历程中不同的范式。
YOLO26 详细信息:
- 作者: Glenn Jocher 和 Jing Qiu
- 组织: Ultralytics
- 日期: 2026-01-14
- GitHub: Ultralytics Repository
- 文档: YOLO26 官方文档
YOLO11 详情:
- 作者: Glenn Jocher 和 Jing Qiu
- 组织: Ultralytics
- 日期: 2024-09-27
- GitHub: Ultralytics Repository
- 文档: YOLO11 官方文档
架构差异与创新#
从 YOLO11 到 YOLO26 的飞跃涉及模型架构和底层训练方案的根本性转变。虽然 YOLO11 为目标检测和多任务学习奠定了稳固的基准,但 YOLO26 对边缘计算的部署管道进行了全面彻底的改造。
端到端无 NMS 设计#
YOLO26 最重要的升级之一是其原生的端到端架构。与依赖非极大值抑制 (NMS) 后处理来过滤重叠边界框的 YOLO11 不同,YOLO26 完全消除了这一步骤。这一最初在 YOLOv10 中开创的概念极大地减少了延迟变异性,并简化了各种边缘设备上的部署逻辑。
移除 DFL 以提升边缘效率#
YOLO11 利用分布焦点损失 (DFL) 来优化边界框估算。然而,DFL 依赖于复杂的 softmax 操作,而低功耗边缘加速器通常对此支持不佳。YOLO26 在不牺牲准确性的前提下成功移除了 DFL。这种架构简化大幅提升了与嵌入式系统的兼容性,并使 YOLO26 相比前代产品实现了高达 43% 的 CPU 推理速度提升。
MuSGD 优化器#
训练的稳定性和速度至关重要。YOLO26 引入了 MuSGD 优化器,这是随机梯度下降 (SGD) 和 Muon 的混合体,深受 Moonshot AI 的 Kimi K2 在大语言模型训练中创新的启发。该优化器将语言模型的训练稳定性引入计算机视觉领域,确保了更快的收敛速度,并相比重型 Transformer 替代方案减少了训练期间的内存占用。
ProgLoss 与 STAL#
对于处理航拍影像或无人机应用的研究人员来说,检测微小特征是一个历史性的挑战。YOLO26 引入了 ProgLoss 与 STAL(尺度目标注意力损失)相结合的技术,与 YOLO11 相比,在小目标识别方面带来了显著的改进。
性能与指标对比#
当直接对比这两个模型时,YOLO26 在精度和边缘设备效率方面表现出明显的优势,同时保持了 Ultralytics 生态系统特有的极低内存需求。
| 模型 | 尺寸 (像素) | mAPval 50-95 | 速度 CPU ONNX (ms) | 速度 T4 TensorRT10 (ms) | 参数量 (M) | FLOPs (B) |
|---|---|---|---|---|---|---|
| YOLO26n | 640 | 40.9 | 38.9 | 1.7 | 2.4 | 5.4 |
| YOLO26s | 640 | 48.6 | 87.2 | 2.5 | 9.5 | 20.7 |
| YOLO26m | 640 | 53.1 | 220.0 | 4.7 | 20.4 | 68.2 |
| YOLO26l | 640 | 55.0 | 286.2 | 6.2 | 24.8 | 86.4 |
| YOLO26x | 640 | 57.5 | 525.8 | 11.8 | 55.7 | 193.9 |
| YOLO11n | 640 | 39.5 | 56.1 | 1.5 | 2.6 | 6.5 |
| YOLO11s | 640 | 47.0 | 90.0 | 2.5 | 9.4 | 21.5 |
| YOLO11m | 640 | 51.5 | 183.2 | 4.7 | 20.1 | 68.0 |
| YOLO11l | 640 | 53.4 | 238.6 | 6.2 | 25.3 | 86.9 |
| YOLO11x | 640 | 54.7 | 462.8 | 11.3 | 56.9 | 194.9 |
注:YOLO26 nano (YOLO26n) 模型相比 YOLO11n 实现了约 31% 的 CPU 速度提升 (38.9ms 对比 56.1ms),突显了其“边缘优先”的设计理念。
计算机视觉任务的多功能性#
这两个模型都受益于维护完善的 Ultralytics 生态系统,通过统一的 Python API 提供无与伦比的易用性。它们不仅仅是目标检测器,更是多任务处理的强力引擎。不过,YOLO26 融入了几项特定任务的改进:
- 实例分割: YOLO26 使用了改进的语义分割损失和多尺度原型,生成比 YOLO11 更清晰的掩码边界。了解有关分割工作流的更多信息。
- 姿态估计: 通过集成残差对数似然估计 (RLE),YOLO26 显著提高了复杂人体姿态中的关键点准确性。探索姿态估计功能。
- 旋转边界框 (OBB): 专用的角度损失函数解决了历史上的边界不连续问题,使得 YOLO26 在检测卫星图像中的旋转物体时异常可靠。阅读有关 OBB 任务的内容。
- 图像分类: 这两个模型都能高效处理高速分类,其中 YOLO26 在 ImageNet 上带来了微幅的 Top-1 准确率提升。
训练与推理代码示例#
Ultralytics 以其极佳的开发者体验而闻名。训练 SOTA 模型或运行推理脚本只需几行代码,从而最大限度地减少样板代码并最大化生产力。此外,训练 YOLO 模型所需的 CUDA 内存显著少于大型 Transformer 网络。
from ultralytics import YOLO
# Load the cutting-edge YOLO26 nano model
model = YOLO("yolo26n.pt")
# Train the model on the COCO8 dataset efficiently
# The MuSGD optimizer is automatically enabled for YOLO26
train_results = model.train(
data="coco8.yaml",
epochs=100,
imgsz=640,
device="0", # Utilize GPU for accelerated training
)
# Perform NMS-free inference directly on an image
results = model("https://ultralytics.com/images/bus.jpg")
# Display the clean, instant predictions
results[0].show()理想用例与部署策略#
在 YOLO26 和 YOLO11 之间做出选择,完全取决于你生产环境的限制。
何时部署 YOLO26#
YOLO26 是现代从零开始 (greenfield) 项目的最终选择。它专为以下场景构建:
- 边缘计算与物联网: 其惊人的 CPU 性能和 DFL 移除特性使其成为 Raspberry Pi、Coral NPU 和移动处理器等设备的佼佼者。
- 无人机与航拍分析: ProgLoss + STAL 的集成使其具备了在广阔视野中追踪微小且快速移动物体的独特能力。
- 对延迟敏感的应用: 在自主机器人或制造质量控制中,无 NMS 的设计可确保确定性延迟,而不会出现意料之外的后处理峰值。
何时保留 YOLO11#
虽然 YOLO26 更胜一筹,但 YOLO11 依然是一个极其强大的模型。如果你符合以下情况,可以选择继续使用 YOLO11:
- 遗留流水线: 你现有的 C++ 部署基础设施与旧架构的特定锚框输出及 NMS 逻辑紧密耦合。
- 学术基准: 你正在发表研究成果,需要一个广受认可的 2024 年标准来作为基准,对比你的新颖算法。
Ultralytics 生态系统的强大力量#
无论你是部署 YOLO11 还是 YOLO26,使用 Ultralytics 模型都意味着接入一个维护良好的生态系统,该系统具有频繁的更新和庞大的社区支持。
对于企业团队,Ultralytics Platform 为数据标注、模型训练和无缝云端部署提供了端到端解决方案。从将你训练好的权重导出到 CoreML 或 TensorRT,到配置高级超参数调优,所提供的工具确保你的 AI 生命周期尽可能精简高效。