Ultralytics YOLO27:

PP-YOLOE+ 対 YOLO26#

リアルタイムコンピュータービジョンの分野は、スケーラブルで効率的かつ高精度な物体検出モデルへの需要に牽引され、目覚ましい成長を遂げています。この分野で特に注目される2つのアーキテクチャが、PaddlePaddleエコシステムの強力な検出器である PP-YOLOE+ と、エッジデプロイメントおよび学習効率を再定義する最新の最先端モデル Ultralytics YOLO26 です。

この包括的なガイドでは、これら2つのモデルを比較し、アーキテクチャ、パフォーマンス指標、学習方法、理想的なユースケースに焦点を当てながら、次のAIプロジェクトに向けて十分な情報に基づいた判断ができるようにします。

技術仕様と開発者情報#

これらのモデルの起源と設計思想を理解することは、実環境での利用に関する重要な背景情報となります。

PP-YOLOE+ の詳細:

PP-YOLOE+の詳細をご覧ください

YOLO26の詳細:

アーキテクチャのイノベーション#

PP-YOLOE+ のアーキテクチャ#

前身のPP-YOLOv2を基盤として構築されたPP-YOLOE+は、産業用途に合わせた堅牢な設計を導入しています。CSPRepResNetバックボーンとET-head(効率的なタスクアライメントヘッド)を活用し、速度と精度のバランスを実現しています。PP-YOLOE+は動的ラベル割り当て(TAL)を利用し、BaiduのPaddlePaddleフレームワークとシームレスに統合されているため、T4やV100などのNVIDIA GPU向けに高度に最適化されています。ただし、PaddlePaddleエコシステムへの依存度が高いため、PyTorchワークフローに慣れた開発者にとっては扱いにくさが生じる可能性があります。

YOLO26のアーキテクチャ: エッジファーストの革新#

2026年初頭にリリースされた Ultralytics YOLO26 は、リアルタイム検出パイプラインを全面的に再構想し、デプロイの容易さとエッジ効率を大幅に重視しています。

YOLO26の主なイノベーションは次のとおりです:

  • エンドツーエンドのNMSフリーデザイン: YOLO26はネイティブでエンドツーエンドに対応しており、非最大抑制(NMS)の後処理を完全に不要にします。YOLOv10で初めて導入されたこの画期的な設計により、シーンの混雑度にかかわらず推論レイテンシが安定し、デプロイが大幅に簡素化されます。
  • DFLの削除: Distribution Focal Loss(DFL)を削除することで、YOLO26は出力ヘッドを大幅に簡素化しています。その結果、エッジデバイスやマイクロコントローラーとの互換性が大きく向上します。
  • CPU推論が最大43%高速: DFLの削除と構造上の最適化により、YOLO26は専用GPUのない環境向けに大幅に最適化されており、YOLO11と比較してCPU上で最大43%高速な推論速度を実現します。
  • MuSGDオプティマイザー: Moonshot AIなどによる高度なLLM学習手法に着想を得て、YOLO26はSGDとMuonを組み合わせたハイブリッド手法を導入しています。これにより、コンピュータービジョンタスクに比類のない学習安定性と、より高速な収束をもたらします。
  • ProgLoss + STAL: 高度な損失関数により、小さな物体の認識を重点的に改善します。これは、ドローン運用やIoTエッジセンサーにおいて重要です。
YOLO26のタスク固有の改善

YOLO26は標準的なバウンディングボックスに加えて、あらゆるビジョンタスクに固有のアップグレードを導入しています。セグメンテーションにはセマンティックセグメンテーション損失とマルチスケールプロトタイピング、姿勢推定にはResidual Log-Likelihood Estimation(RLE)、回転バウンディングボックス(OBB)検出には境界の問題を解決する専用の角度損失を使用します。

パフォーマンスとメトリクス#

以下の表では、さまざまなモデルサイズにおけるPP-YOLOE+とYOLO26の比較を詳しく示します。YOLO26モデルは、実速度、パラメーター効率、全体的な平均適合率(mAP)において明確に優れています。

モデルサイズ
(ピクセル)
mAPval
50-95
速度
CPU ONNX
(ms)
速度
T4 TensorRT10
(ms)
パラメーター数
(M)
FLOPs
(B)
PP-YOLOE+t64039.9-2.844.8519.15
PP-YOLOE+s64043.7-2.627.9317.36
PP-YOLOE+m64049.8-5.5623.4349.91
PP-YOLOE+l64052.9-8.3652.2110.07
PP-YOLOE+x64054.7-14.398.42206.59
YOLO26n64040.938.91.72.45.4
YOLO26s64048.687.22.59.520.7
YOLO26m64053.1220.04.720.468.2
YOLO26l64055.0286.26.224.886.4
YOLO26x64057.5525.811.855.7193.9

注: 太字の値は、すべてのモデルの中で最も優れた指標を示します。

分析#

  • メモリ要件と効率: YOLO26は、より高いmAPスコアを達成しながら、必要なパラメーター数とFLOPsを大幅に削減します。たとえば、YOLO26n(Nano)モデルは、わずか2.4M個のパラメーターで40.9 mAPを達成し、サイズがほぼ半分でありながらPP-YOLOE+tモデルを上回ります。これにより、学習中とデプロイ中の両方でメモリ使用量を削減できます。
  • 推論速度: TensorRTを使用してエクスポートすると、YOLO26はレイテンシ指標で圧倒的な性能を発揮します。NMSを削除しているため、T4 GPUでの1.7msの推論時間が完全に安定する一方、PP-YOLOE+では後処理時間が変動する可能性があります。

Ultralyticsの強み:エコシステムと使いやすさ#

実速度の指標は重要ですが、プロジェクトの成功は開発者体験によって決まることも少なくありません。Ultralytics Platform は、従来のフレームワークを大きく上回る、十分に保守されたエコシステムを提供します。

  1. 使いやすさ: Ultralyticsは複雑なボイラープレートコードを抽象化します。YOLO26の学習には数行のPythonしか必要なく、PP-YOLOE+で必要となる大量の設定ファイルを避けられます。
  2. 汎用性: PP-YOLOE+は主に物体検出用のアーキテクチャです。YOLO26は、セグメンテーション、分類、姿勢推定、OBBをすぐに利用できる形でサポートします。
  3. 学習効率: Ultralytics YOLOモデルは、RT-DETRのような大規模なTransformerモデルや旧世代のアーキテクチャと比較して、必要なCUDAメモリがはるかに少ないため、研究者はコンシューマー向けハードウェア上で最先端モデルを学習できます。
その他のUltralyticsモデル

YOLO26は現在の研究の頂点に位置しますが、UltralyticsエコシステムにはYOLO11YOLOv8も含まれています。どちらも大規模なコミュニティサポートを持つ非常に高性能なモデルであり、旧来のレガシーシステムから移行するユーザーに適しています。

コード例:YOLO26のトレーニング#

Ultralyticsの利用開始はスムーズです。以下に、YOLO26モデルの読み込み、学習、検証方法を示す、完全に実行可能な例を示します。

from ultralytics import YOLO

# Load the cutting-edge YOLO26 small model
model = YOLO("yolo26s.pt")

# Train the model on the COCO8 dataset using the new MuSGD optimizer
results = model.train(
    data="coco8.yaml",
    epochs=100,
    imgsz=640,
    batch=16,
    optimizer="auto",  # MuSGD is automatically engaged for YOLO26
)

# Export seamlessly to ONNX for CPU deployment
export_path = model.export(format="onnx")
print(f"Model successfully exported to: {export_path}")

理想的なユースケース#

PP-YOLOE+ を選択するケース#

  • レガシーPaddlePaddleインフラストラクチャ: 企業がすでにBaiduのテクノロジースタックに深く組み込まれており、Paddle Inference用に事前構成されたハードウェアを使用している場合、PP-YOLOE+は安全で安定した選択肢です。
  • アジアの製造拠点: アジアの多くの産業用ビジョンパイプラインでは、自動欠陥検出におけるPP-YOLOE+の堅牢な既存サポートが提供されています。

YOLO26を選ぶタイミング#

  • エッジコンピューティングとIoT: CPU推論が43%高速でDFLを削除しているため、YOLO26はRaspberry Pi、携帯電話、組み込みデバイスへのデプロイにおいて、誰もが認める最適な選択肢です。
  • 混雑したシーンとスマートシティ: エンドツーエンドのNMSフリーアーキテクチャにより、駐車場管理や交通監視など、従来のNMSがボトルネックを引き起こす高密度環境でも、安定したレイテンシが保証されます。
  • マルチタスクプロジェクト: パイプラインで物体の追跡、人間の姿勢推定、ピクセル単位で正確なマスクの生成が必要な場合、YOLO26は単一の統合されたPythonパッケージ内ですべてに対応します。

まとめ#

PP-YOLOE+は特定のエコシステム内で非常に高性能な検出器であり続けていますが、YOLO26のリリースによってパラダイムは変化しました。LLMに着想を得た学習最適化(MuSGD)と、徹底的に最適化されたNMSフリーアーキテクチャを組み合わせることで、Ultralyticsは高精度でありながら容易にデプロイできるモデルを実現しました。速度、精度、開発者体験の最適なバランスを求める現代の開発者にとって、YOLO26は決定的な選択肢です。

コメント