YOLO Vision 2026:

Ultralytics YOLO26#

概要#

Ultralytics YOLO26 は、Ultralytics YOLO26 paper で解説されているリアルタイムビジョンモデルの統合ファミリーです。ネイティブのエンドツーエンド推論、より軽量な検出ヘッド、アップデートされた学習レシピ、そして検出、セグメンテーション、姿勢推定、分類、回転検出のためのタスク固有ヘッドを導入しています。

5つの検出スケール全体で、YOLO26は1.7-11.8 msのT4 TensorRTレイテンシで、COCO上で40.9-57.5 mAPを達成します。同論文では、Intel Xeon CPU @ 2.00 GHzにおいて、YOLO11nと比較してYOLO26nのCPU ONNX推論が最大43%高速化されたことも報告されています。

Ultralytics YOLO26 Comparison Plots



Watch: How to Train a YOLO26 model on Your Custom Dataset in Google Colab.
クイックスタート
from ultralytics import YOLO

model = YOLO("yolo26n.pt")  # load a pretrained YOLO26n model
results = model("path/to/bus.jpg")  # run inference
Ultralytics Platformで試す

Ultralytics Platform 上で直接 YOLO26 モデルを探索して実行できます。

YOLO26モデルファミリーは、4つの設計領域を中心に構築されています。

  • ネイティブなエンドツーエンド推論: デフォルトの1対1検出ヘッドは、非最大値抑制(NMS)なしで予測を生成するため、デプロイメントが簡素化され、後処理が軽減されます。
  • 軽量なボックス回帰: YOLO26はDistribution Focal Loss (DFL)を削除し、制約のない回帰範囲を維持しながら検出ヘッドの複雑さを低減しています。
  • 学習レシピのアップデート: 学習パイプラインでは、MuSGD(Muon と SGD のハイブリッドオプティマイザ)、Progressive LossSTAL(Small-Target-Aware Label Assignment)を組み合わせて最適化を改善し、監視を推論時のヘッドへとシフトさせ、小さな物体に対するポジティブなラベルカバレッジを維持します。リリースされたチェックポイントの背後にある完全なハイパーパラメータについては、YOLO26 Training Recipe guide にドキュメント化されています。
  • タスク固有のヘッドとロス: YOLO26は、インスタンスセグメンテーション、セマンティックセグメンテーションのバリエーション、ポーズ推定、回転物体検出のためのターゲット設計を追加しつつ、タスク間で単一のモデルパイプラインを維持します。

これらのアップデートにより、モデルのスケールやデプロイ先全体での精度とレイテンシのトレードオフが向上します。

主な特徴#

  • DFL不要の回帰 YOLO26はDistribution Focal Loss (DFL)を削除し、検出ヘッドの複雑さを低減してエクスポートを簡素化します。

  • エンドツーエンドのNMS不要推論 NMSを別個の後処理ステップとして依存する従来の検出器とは異なり、YOLO26はデフォルトでネイティブなエンドツーエンドです。予測が直接生成されるため、レイテンシが短縮され、本番環境への統合がより単純になります。

  • Progressive Loss + STAL Progressive Lossはトレーニングの重点を推論時のヘッドへとシフトさせ、STALは小さな物体に対する正解ラベルの網羅性を改善します。

  • MuSGD オプティマイザ SGDMuon を組み合わせたハイブリッドオプティマイザであり、大規模言語モデルの学習における最適化のアイデアをコンピュータビジョンに適応させています。

  • 効率的なデプロイメント 簡素化されたヘッドとNMS不要のデフォルトパスにより、エクスポートターゲットやハードウェアプロファイル全体で推論のオーバーヘッドが削減されます。これには、YOLO11nに対するYOLO26nの論文で報告されたCPU ONNXの高速化も含まれます。

  • インスタンスセグメンテーションの強化 モデルの収束を改善するためのセマンティックセグメンテーションロスと、優れたマスク品質のためにマルチスケール情報を活用するアップグレードされたprotoモジュールが導入されました。論文では、COCOインスタンスセグメンテーションにおいて、YOLO11と比較して最大+2.5のボックスAPおよび+3.7のマスクAP向上が報告されています。

  • 高精度な姿勢推定 キーポイントのより正確なローカライゼーションのために Residual Log-Likelihood Estimation(RLE)を統合し、推論速度の向上に向けてデコードプロセスを最適化しています。論文では、COCO 姿勢推定において YOLO11 を上回る最大 +7.2 AP が報告されています。

  • OBDデコードの洗練 正方形の物体に対する検出精度を向上させるための特殊な角度ロスを導入し、境界の不連続性の問題を解決するためにOBDデコードを最適化しました。論文では、DOTA-v1.0の回転物体検出において、YOLO11に対して最大+3.4 mAPの向上が報告されています。

Ultralytics YOLO26 End-to-End Comparison Plots


サポートされるタスクとモード#

YOLO26は、5つのモデルスケール全体で標準的なUltralyticsタスクセットをサポートしています。

モデルファイル名タスクトレーニングバリデーション推論エクスポート
YOLO26yolo26n.pt yolo26s.pt yolo26m.pt yolo26l.pt yolo26x.ptDetection
YOLO26-segyolo26n-seg.pt yolo26s-seg.pt yolo26m-seg.pt yolo26l-seg.pt yolo26x-seg.ptInstance Segmentation
YOLO26-semyolo26n-sem.pt yolo26s-sem.pt yolo26m-sem.pt yolo26l-sem.pt yolo26x-sem.ptSemantic Segmentation
YOLO26-depthyolo26n-depth.pt yolo26s-depth.pt yolo26m-depth.pt yolo26l-depth.pt yolo26x-depth.ptDepth Estimation
YOLO26-clsyolo26n-cls.pt yolo26s-cls.pt yolo26m-cls.pt yolo26l-cls.pt yolo26x-cls.ptClassification
YOLO26-poseyolo26n-pose.pt yolo26s-pose.pt yolo26m-pose.pt yolo26l-pose.pt yolo26x-pose.ptPose/Keypoints
YOLO26-obbyolo26n-obb.pt yolo26s-obb.pt yolo26m-obb.pt yolo26l-obb.pt yolo26x-obb.ptOriented Detection

この統合フレームワークは、リアルタイム検出、インスタンスセグメンテーション、セマンティックセグメンテーション、単眼深度推定、分類、姿勢推定、および指向性物体検出をカバーしており、トレーニング、検証、推論、およびエクスポートをサポートしています。

アーキテクチャのみのバリエーション

yolo26-p2.yaml および yolo26-p6.yaml は、P2(小物体)または P6(大規模入力)の検出ヘッドを追加し、YAML アーキテクチャとしてのみ提供されます。スケール固有の yolo26*-p2.ptyolo26*-p6.pt の重みはリリースされません。YAML からスケール設定をインスタンス化し(例: YOLO("yolo26n-p6.yaml"))、必要に応じて学習またはファインチューニングを行ってください。


性能メトリクス#

性能

COCO で学習された80の事前トレーニング済みクラスを含むこれらのモデルの使用例については、Detection Docs をご覧ください。

モデルサイズ
(ピクセル)
mAPval
50-95
mAPval
50-95(e2e)
速度
CPU ONNX
(ms)
速度
T4 TensorRT10
(ms)
パラメータ
(M)
FLOPs
(B)
YOLO26n64040.940.138.9 ± 0.71.7 ± 0.02.45.4
YOLO26s64048.647.887.2 ± 0.92.5 ± 0.09.520.7
YOLO26m64053.152.5220.0 ± 1.44.7 ± 0.120.468.2
YOLO26l64055.054.4286.2 ± 2.06.2 ± 0.224.886.4
YOLO26x64057.556.9525.8 ± 4.011.8 ± 0.255.7193.9

パラメータ数および FLOPs の値は、Conv レイヤーと BatchNorm レイヤーを統合し、補助的な多対1(one-to-many)検出ヘッドを削除する model.fuse() 処理後の統合モデルに関するものです。事前学習済みチェックポイントは完全な学習アーキテクチャを保持しており、より高い数値を示す場合があります。


使用例#

このセクションでは、シンプルな YOLO26 の学習および推論の例を示します。これらおよびその他のモードに関する完全なドキュメントについては、PredictTrainVal、および Export のドキュメントページを参照してください。

以下の例は、object detection 用の YOLO26 Detect モデルに関するものであることに注意してください。その他のサポートされているタスクについては、SegmentSemantic SegmentationDepthClassifyPose、および OBB のドキュメントをご覧ください。

PyTorch の事前学習済み *.pt モデル、および設定用 *.yaml ファイルを YOLO() クラスに渡すことで、Python でモデルインスタンスを作成できます:

from ultralytics import YOLO

# Load a COCO-pretrained YOLO26n model
model = YOLO("yolo26n.pt")

# Run inference with the YOLO26n model on the 'bus.jpg' image
results = model("path/to/bus.jpg")

# Train the model on the COCO8 example dataset for 100 epochs
results = model.train(data="coco8.yaml", epochs=100, imgsz=640)
デュアルヘッドアーキテクチャ

YOLO26検出モデルは、さまざまなデプロイシナリオに対応できる柔軟性を備えた デュアルヘッドアーキテクチャ を採用しています。

  • 一対一ヘッド(デフォルト): NMS なしでエンドツーエンドの予測を行し、1画像あたり最大300個の検出結果を持つ (N, 300, 6) を出力します。このヘッドは、高速な推論と簡素化されたデプロイ向けに最適化されています。
  • One-to-Many Head: NMSの後処理を必要とする従来のYOLO出力を生成し、(N, nc + 4, 8400) を出力します。ここで、nc はクラスの数です。このヘッドは通常、追加の処理コストと引き換えに、わずかに高い精度を達成します。

エクスポート、予測、またはバリデーションの実行中にヘッドを切り替えることができます。

from ultralytics import YOLO

model = YOLO("yolo26n.pt")

# Use one-to-one head (default, no NMS required)
results = model.predict("image.jpg")  # inference
metrics = model.val(data="coco.yaml")  # validation
model.export(format="onnx")  # export

# Use one-to-many head (requires NMS)
results = model.predict("image.jpg", end2end=False)  # inference
metrics = model.val(data="coco.yaml", end2end=False)  # validation
model.export(format="onnx", end2end=False)  # export

選択はデプロイ要件に依存します。最大限の速度とシンプルさを求める場合はone-to-oneヘッドを使用し、精度を最優先する場合はone-to-manyヘッドを使用してください。

YOLOE-26: オープンボキャブラリー検出およびセグメンテーション#

YOLO26 は、学習時に学習された固定のクラスリストの代わりに、テキストプロンプトビジュアルプロンプト、またはプロンプトフリーモードからオブジェクトカテゴリを検出しセグメント化するオープンボキャブラリーバリアントである YOLOE-26 も駆動します。YOLOE-26 は YOLO26 の NMS 不要なエンドツーエンド(e2e)デザインを維持しているため、ターゲットカテゴリが時間とともに変化する動的な環境でも、オープンボキャブラリー推論を十分に高速に保つことができます。YOLOE-26x は、テキストプロンプト下で LVIS minival において 40.6 AP、ビジュアルプロンプト下で 38.5 AP、プロンプトフリーの非 E2E 設定で 31.1 AP に達します。

スケールごとのパフォーマンス表、プロンプトフリーのバリアント、および完全な使用例については、YOLOE documentation を参照してください。

引用と謝辞#

YOLO26 のアーキテクチャ、学習レシピ、タスクヘッド、および YOLOE-26 オープンボキャブラリー拡張の詳細な技術解説については、Ultralytics YOLO26: Unified Real-Time End-to-End Vision Models をお読みください。研究で YOLO26 を使用する場合は、以下を引用してください:

引用
@misc{jocher2026ultralyticsyolo26unifiedrealtime,
  title = {Ultralytics YOLO26: Unified Real-Time End-to-End Vision Models},
  author = {Glenn Jocher and Jing Qiu and Mengyu Liu and Shuai Lyu and Fatih Cagatay Akyon and Muhammet Esat Kalfaoglu},
  year = {2026},
  eprint = {2606.03748},
  archivePrefix = {arXiv},
  primaryClass = {cs.CV},
  doi = {10.48550/arXiv.2606.03748},
  url = {https://arxiv.org/abs/2606.03748},
}

YOLO26 のコード、モデル、およびドキュメントは、Ultralytics GitHub repository および Ultralytics Docs にて、AGPL-3.0 および Enterprise ライセンスのもとで提供されています。


よくある質問 (FAQ)#

YOLO26における主な改善点は何ですか?#

  • DFL-free回帰: 検出ヘッドとエクスポートパスを簡素化します。
  • エンドツーエンドのNMS-free推論: デフォルトの推論パスからNMSを削除します。
  • Progressive Loss + STAL: 学習の整合性と小さなオブジェクトのラベルカバレッジを向上させます。
  • MuSGDオプティマイザー: SGDとMuon風の最適化を組み合わせ、安定した学習を実現します。
  • タスク固有のヘッドと損失: セグメンテーション、姿勢推定、回転オブジェクト検出のサポートを強化します。

YOLO26はどのようなタスクをサポートしていますか?#

YOLO26は統合モデルファミリであり、複数のコンピュータビジョンのタスクに対してエンドツーエンドのサポートを提供します。

各サイズバリアント(n、s、m、l、x)は、すべてのタスクに加え、YOLOE-26 によるオープンボキャブラリーバージョンをサポートしています。

なぜ YOLO26 はデプロイメントにおいて効率的なのでしょうか?#

YOLO26 は以下の点によりデプロイメントの効率を向上させます。

  • デフォルトで NMS を必要としないネイティブなエンドツーエンド推論
  • DFL 不要の回帰と軽量化された検出ヘッド
  • トレーニング専用の補助コンポーネントを削除するフューズドモデルエクスポート
  • Intel Xeon CPU @ 2.00 GHz における YOLO11n と比較して、YOLO26n は CPU ONNX 推論が最大 43% 高速化
  • TensorRT、ONNX、CoreML、LiteRT、OpenVINOを含む柔軟なエクスポート形式

YOLO26 はどのように始めればよいですか?#

YOLO26 モデルは ultralytics パッケージからダウンロードして利用できます。パッケージのインストールまたはアップデートを行い、モデルを読み込んでください:

from ultralytics import YOLO

# Load a pretrained YOLO26 nano model
model = YOLO("yolo26n.pt")

# Run inference on an image
results = model("image.jpg")

学習、検証、およびエクスポートの手順については、Usage Examples セクションを参照してください。

コメント