YOLO Vision 2026:

Umfassende Tutorials für Ultralytics YOLO#

Willkommen bei den YOLO-Anleitungen von Ultralytics. Unsere umfassenden Tutorials behandeln verschiedene Aspekte des YOLO Objekterkennungs-Modells, von Training und Vorhersage bis hin zur Bereitstellung. YOLO basiert auf PyTorch und zeichnet sich durch außergewöhnliche Geschwindigkeit und Genauigkeit bei Echtzeit-Objekterkennungsaufgaben aus.

Egal, ob du Anfänger oder Experte im Bereich Deep Learning bist, unsere Tutorials bieten wertvolle Einblicke in die Implementierung und Optimierung von YOLO für deine Computer Vision-Projekte.



Watch: Ultralytics YOLO26 Guides Overview

Anleitungen#

Die Anleitungen sind nach Projektphasen gruppiert – von der Einrichtungs- und Datenvorbereitung bis hin zu Training, Evaluierung, Deployment, Inferenzoptimierung und Edge-Hardware –, damit du direkt zu dem Schritt springen kannst, an dem du gerade arbeitest.

Erste Schritte & Planung#

  • Conda Quickstart: Schritt-für-Schritt-Anleitung zur Einrichtung einer Conda-Umgebung für Ultralytics. Lerne, wie du das Ultralytics-Paket effizient installierst und mit Conda nutzt.
  • Docker Quickstart: Vollständige Anleitung zur Einrichtung und Nutzung von Ultralytics YOLO-Modellen mit Docker. Lerne, wie du Docker installierst, GPU-Unterstützung verwaltest und YOLO-Modelle in isolierten Containern für konsistente Entwicklung und Bereitstellung ausführst.
  • AzureML Quickstart: Lege los mit Ultralytics YOLO-Modellen auf Microsofts Azure Machine Learning-Plattform. Erfahre, wie du deine Objekterkennungsprojekte in der Cloud trainierst, bereitstellst und skalierst.
  • Modal Quickstart: Führe Ultralytics YOLO26 auf der serverlosen Cloud-Plattform von Modal aus. Dies umfasst Authentifizierung, GPU-Inferenz und Trainingsjobs mit persistentem Speicher – ohne dass du Infrastruktur verwalten musst.
  • Projektziele für Computer Vision definieren: Erfahre, wie du effektiv klare und messbare Ziele für dein Computer Vision-Projekt definierst. Lerne die Bedeutung einer gut definierten Problemstellung kennen und wie sie einen Fahrplan für dein Projekt erstellt.
  • Schritte eines Computer Vision-Projekts: Erfahre mehr über die wichtigsten Schritte in einem Computer Vision-Projekt, einschließlich der Definition von Zielen, der Auswahl von Modellen, der Datenaufbereitung und der Bewertung der Ergebnisse.
  • YOLO Architecture Explained: Verfolge, wie sich die YOLO-Architektur von YOLOv3 bis YOLO26 über Backbone, Neck und Detection Head entwickelt hat, und decke dabei C2f, C3k2, C2PSA Attention, anchor-free sowie NMS-free Design ab.

Bereite deine Daten vor#

  • Datensammlung und Annotation: Entdecke die Werkzeuge, Techniken und bewährten Methoden zum Sammeln und Annotieren von Daten, um hochwertige Eingaben für deine Computer Vision-Modelle zu erstellen.
  • Vorverarbeitung annotierter Daten: Lerne die Datenvorverarbeitung für Computer Vision mit YOLO26, einschließlich Bildgrößenänderung, Normalisierung, Datensatzaufteilung, Datenaugmentierung und explorativer Datenanalyse (EDA).
  • YOLO Datenaugmentierung: Meistere das gesamte Spektrum der Datenaugmentierungstechniken in YOLO, von einfachen Transformationen bis zu fortgeschrittenen Strategien zur Verbesserung der Modellrobustheit und -leistung.
  • COCO zu YOLO Konvertierung: Vollständiger Leitfaden zur Konvertierung von COCO JSON-Annotationen in das YOLO-Format für das Training. Behandelt Erkennung, Segmentierung und Keypoints, einschließlich der Zuordnung von Klassen-IDs und häufigen Konvertierungsfehlern.
  • COCO JSON Training: Trainiere YOLO direkt mit COCO JSON-Annotationen, ohne in das YOLO-Format zu konvertieren, unter Verwendung einer benutzerdefinierten Dataset-Klasse und eines Trainers.

Trainieren & Feintuning#

  • Tipps für das Modelltraining: Entdecke Tipps zur Optimierung von Batch-Größen, zur Verwendung von gemischter Präzision, zum Anwenden von vortrainierten Gewichten und mehr, um das Training deines Computer Vision-Modells zum Kinderspiel zu machen.
  • Fine-Tuning von YOLO mit benutzerdefinierten Daten: Vollständiger Leitfaden zum Fine-Tuning von YOLO26 auf benutzerdefinierten Datensätzen mit vortrainierten Gewichten, inklusive Transfer Learning, Einfrieren von Ebenen, Optimiererauswahl, zweistufigem Training und Fehlerbehebung.
  • YOLO26 Trainingsrezept: Vollständige Dokumentation der Hyperparameter, Augmentierungs-Pipelines und Optimierereinstellungen, die zum Training der offiziellen YOLO26-Basis-Checkpoints auf COCO verwendet wurden, inklusive praktischer Anleitungen zum Fine-Tuning.
  • Hyperparameter-Optimierung: Entdecke, wie du deine YOLO-Modelle durch die Feinabstimmung von Hyperparametern mit der Tuner-Klasse und genetischen Evolutionsalgorithmen optimierst.
  • Knowledge Distillation: Erfahre, wie du die Modellleistung verbesserst, indem du Wissen von einem größeren Lehrermodell auf ein kleineres Schülermodell mittels merkmalsbasierter Destillation überträgst.
  • K-Fold Kreuzvalidierung: Lerne, wie du die Modellgeneralisierung mithilfe der K-Fold-Kreuzvalidierungstechnik verbesserst.
  • Trainer anpassen: Lerne, wie du den YOLO-Trainer als Unterklasse definierst, um benutzerdefinierte Metriken zu protokollieren, klassengewichtete Verluste hinzuzufügen, das Speichern von Modellen anzupassen, das Backbone einzufrieren/aufzutauen und Lernraten pro Ebene festzulegen.
  • Modell-YAML-Konfigurationsleitfaden: Ein umfassender Einblick in die Modellarchitekturdefinitionen von Ultralytics. Erkunde das YAML-Format, verstehe das Modulauflösungssystem und lerne, wie du benutzerdefinierte Module nahtlos integrierst.

Evaluieren & Fehlerbehebung#

  • YOLO Leistungsmetriken ⭐ WESENTLICH: Verstehe die wichtigsten Metriken wie mAP, IoU und F1-Score, die zur Bewertung der Leistung deiner YOLO-Modelle verwendet werden. Enthält praktische Beispiele und Tipps zur Verbesserung der Erkennungsgenauigkeit und Geschwindigkeit.
  • Einblicke in die Modellevaluierung und das Fine-Tuning: Evaluiere Computer-Vision-Modelle mit Metriken wie mAP und IoU und optimiere anschließend Trainingsparameter wie das Learning-Rate-Warmup, um die Erkennungsgenauigkeit zu verbessern.
  • Model Testing: Lerne, wie du Computer-Vision-Modelle mit unbekannten Daten testest, YOLO26-Modelle validierst und Overfitting, Underfitting sowie Data Leakage vor der Bereitstellung erkennst.
  • Häufige YOLO-Probleme ⭐ EMPFOHLEN: Praktische Lösungen und Tipps zur Fehlerbehebung für die am häufigsten auftretenden Probleme bei der Arbeit mit Ultralytics YOLO-Modellen.
  • Dein Computer Vision-Modell pflegen: Verstehe die wichtigsten Praktiken zur Überwachung, Wartung und Dokumentation von Computer Vision-Modellen, um Genauigkeit zu garantieren, Anomalien zu erkennen und Daten-Drift zu mindern.

Deployment & Bereitstellung#

  • Modellbereitstellungsoptionen: Überblick über YOLO Modellbereitstellungs-Formate wie ONNX, OpenVINO und TensorRT, mit Vor- und Nachteilen für jedes Format, um deine Bereitstellungsstrategie zu unterstützen.
  • Best Practices für die Modellbereitstellung: Gehe Tipps und bewährte Verfahren für die effiziente Bereitstellung von Modellen in Computer Vision-Projekten durch, mit Fokus auf Optimierung, Fehlerbehebung und Sicherheit.
  • Nicht-YOLO-Modelle exportieren: Nutze die eigenständigen Export-Dienstprogramme von Ultralytics, um jedes torch.nn.Module (timm, torchvision, benutzerdefiniert) in ONNX, TorchScript, OpenVINO, CoreML, NCNN, MNN, PaddlePaddle, ExecuTorch und TensorFlow SavedModel zu konvertieren.
  • End-to-End-Erkennung: Verstehe die NMS-freie End-to-End-Erkennung von YOLO26, die Exportkompatibilität, Änderungen am Ausgabeformat und wie du von älteren YOLO-Modellen migrierst.
  • Triton Inference Server Integration: Tauche ein in die Integration von Ultralytics YOLO26 mit dem Triton Inference Server von NVIDIA für skalierbare und effiziente Deep Learning-Inferenz-Bereitstellungen.
  • YOLO Thread-sichere Inferenz: Richtlinien für die Durchführung von Inferenz mit YOLO-Modellen auf Thread-sichere Weise. Lerne die Bedeutung von Thread-Sicherheit und bewährte Verfahren kennen, um Race Conditions zu vermeiden und konsistente Vorhersagen sicherzustellen.
  • ROS Quickstart: Lerne, wie du YOLO in das Robot Operating System (ROS) für Echtzeit-Objekterkennung in Robotikanwendungen integrierst, einschließlich Punktwolken- und Tiefenbildern.
  • Vertex AI Bereitstellung mit Docker: Optimierter Leitfaden zur Containerisierung von YOLO-Modellen mit Docker und deren Bereitstellung auf Google Cloud Vertex AI – deckt Build, Push, Autoscaling und Überwachung ab.

Inferenz optimieren#

  • SAHI Tiled Inference: Umfassender Leitfaden zur Nutzung der Sliced-Inference-Fähigkeiten von SAHI mit YOLO26 für die Objekterkennung in hochauflösenden Bildern.
  • OpenVINO Latenz vs. Durchsatz-Modi: Lerne Techniken zur Optimierung von Latenz und Durchsatz für maximale YOLO-Inferenzleistung.
  • NVIDIA DALI GPU-Vorverarbeitung: Eliminiere Engpässe bei der CPU-Vorverarbeitung, indem du YOLO-Letterbox-Resize, Padding und Normalisierung auf der GPU mittels NVIDIA DALI durchführst, inklusive Triton Inference Server-Integration.
  • Segmentierungsobjekte isolieren: Schritt-für-Schritt-Rezept und Erklärung, wie du mit Ultralytics Segmentation Objekte aus Bildern extrahierst und/oder isolierst.
  • Inferenzbilder im Terminal anzeigen: Nutze das integrierte Terminal von VSCode, um Inferenz-Ergebnisse bei der Verwendung von Remote Tunnel- oder SSH-Sitzungen anzuzeigen.

Edge- & Embedded-Hardware#

  • NVIDIA Jetson: Quickstart-Anleitung für die Bereitstellung von YOLO-Modellen auf NVIDIA Jetson-Geräten.
  • Raspberry Pi: Quickstart-Tutorial zur Ausführung von YOLO-Modellen auf der neuesten Raspberry Pi-Hardware.
  • DeepStream auf NVIDIA Jetson: Quickstart-Anleitung für die Bereitstellung von YOLO-Modellen auf NVIDIA Jetson-Geräten mittels DeepStream und TensorRT.
  • Edge TPU auf Raspberry Pi: Google Edge TPU beschleunigt YOLO-Inferenz auf Raspberry Pi.
  • NVIDIA DGX Spark: Quickstart-Anleitung für die Bereitstellung von YOLO-Modellen auf NVIDIA DGX Spark-Geräten.
  • DL Streamer on Intel: Schnellstartanleitung für die Bereitstellung von YOLO26-Modellen auf Intel Core Ultra Series 3-Geräten mit DL Streamer und OpenVINO™.

Trage zu unseren Anleitungen bei#

Wir freuen uns über Beiträge aus der Community! Wenn du einen bestimmten Aspekt von Ultralytics YOLO gemeistert hast, der in unseren Anleitungen noch nicht abgedeckt ist, ermutigen wir dich, dein Fachwissen zu teilen. Eine Anleitung zu schreiben ist eine großartige Möglichkeit, der Community etwas zurückzugeben und uns dabei zu helfen, unsere Dokumentation umfassender und benutzerfreundlicher zu gestalten.

Um loszulegen, lies bitte unseren Contributing Guide für Richtlinien zum Erstellen eines Pull Request (PR). Wenn du eine neue Anleitung hinzufügst, ordne sie der passenden Kategorie oben zu, die ihrer Projektphase entspricht, und beschränke sie auf einen Seitentyp – ein Schritt-für-Schritt-Tutorial, eine aufgabenorientierte Anleitung oder eine Referenz –, damit die Sammlung auch bei wachsendem Umfang übersichtlich bleibt. Wir freuen uns auf deine Beiträge.

FAQ#

  • Das Trainieren eines benutzerdefinierten Objekterkennungsmodells mit Ultralytics YOLO ist unkompliziert. Beginne damit, deinen Datensatz im richtigen Format vorzubereiten und das Ultralytics-Paket zu installieren. Verwende den folgenden Code, um das Training zu starten:

    Beispiel
    from ultralytics import YOLO
    
    model = YOLO("yolo26n.pt")  # Load a pretrained YOLO model
    model.train(data="path/to/dataset.yaml", epochs=50)  # Train on custom dataset

    Für detaillierte Datensatzformatierungen und zusätzliche Optionen, lies unseren Leitfaden Tipps für das Modelltraining.

  • Die Bewertung deiner YOLO-Modellleistung ist entscheidend, um ihre Wirksamkeit zu verstehen. Zu den wichtigsten Metriken gehören Mean Average Precision (mAP), Intersection over Union (IoU) und der F1-Score. Diese Metriken helfen bei der Beurteilung der Genauigkeit und Präzision von Objekterkennungsaufgaben. Mehr über diese Metriken und wie du dein Modell verbessern kannst, erfährst du in unserem Leitfaden YOLO Leistungsmetriken.

  • Die Ultralytics Platform ist eine No-Code-Plattform, die das Verwalten, Trainieren und Bereitstellen von YOLO-Modellen vereinfacht. Sie unterstützt nahtlose Integration, Echtzeit-Tracking und Cloud-Training, was sie ideal für Anfänger und Profis gleichermaßen macht. Entdecke mehr über ihre Funktionen und wie sie deinen Workflow mit unserem Ultralytics Platform Quickstart-Guide optimieren kann.

  • Häufige Probleme beim Training von YOLO-Modellen sind Fehler bei der Datenformatierung, nicht übereinstimmende Modellarchitekturen und unzureichende Trainingsdaten. Um diese zu beheben, stelle sicher, dass dein Datensatz korrekt formatiert ist, überprüfe auf kompatible Modellversionen und augmentiere deine Trainingsdaten. Eine umfassende Liste von Lösungen findest du in unserem Leitfaden Häufige YOLO-Probleme.

  • Das Bereitstellen von YOLO-Modellen auf Edge-Geräten wie NVIDIA Jetson und Raspberry Pi erfordert die Konvertierung des Modells in ein kompatibles Format wie TensorRT oder LiteRT. Folge unseren Schritt-für-Schritt-Anleitungen für NVIDIA Jetson und Raspberry Pi Bereitstellungen, um mit der Echtzeit-Objekterkennung auf Edge-Hardware zu beginnen. Diese Anleitungen führen dich durch Installation, Konfiguration und Leistungsoptimierung.

Kommentare