Ultralytics YOLO27:
Get Started

Datensätze#

Ultralytics Platform-Datensätze bieten eine optimierte Lösung für die Verwaltung deiner Trainingsdaten. Nach dem Upload verarbeitet die Plattform Bilder, Labels und Statistiken automatisch.

Ein Datensatz ist bereit für das Training, sobald die Verarbeitung abgeschlossen ist, er mindestens ein Bild in der Aufteilung train, mindestens ein Bild entweder in der Aufteilung val oder test und mindestens ein beschriftetes Bild enthält. Im Datensatzkopf wird ein Ready-Badge angezeigt, wenn alle drei Bedingungen erfüllt sind, andernfalls ein Not Ready-Badge – klicke auf das Badge, um genau zu sehen, welche Bedingung nicht erfüllt ist.

Bilder mit Agents sammeln#

Verwende Agents, um Bilder zu einem Datensatz hinzuzufügen, wenn eine Modellerkennung eine Bedingung erfüllt, etwa wenn die Konfidenz innerhalb eines ausgewählten Bereichs liegt. Verbinde die Bedingung mit einem Datensatz-Block und wähle ein Ziel aus, das du bearbeiten kannst. Die Bilder werden unbeschriftet in die Aufteilung train übernommen; bereits vorhandene Kopien werden übersprungen. Prüfe und beschrifte sie mit dem vorhandenen Annotationseditor.

Datensatz hochladen#

Ultralytics Platform unterstützt verschiedene Upload-Formate und bietet dir damit mehr Flexibilität.

Hast du deine Daten bereits an anderer Stelle?

Wenn du bereits Datensätze in Roboflow hast, kannst du sie über Integrationen direkt importieren – ein manueller Export oder erneuter Upload ist nicht nötig. Daten in Google Cloud Storage, Amazon S3 oder Azure Blob Storage kannst du direkt über Cloud-Speicher verwenden. Enterprise-Arbeitsbereiche können On Premise nutzen, um lokale Daten zu indizieren und damit zu trainieren, ohne Bilddaten an Platform zu senden.

Unterstützte Formate#

FormatErweiterungenHinweiseMax. Größe
JPEG.jpg, .jpegAm weitesten verbreitet, empfohlen50 MB
PNG.pngUnterstützt Transparenz50 MB
WebP.webpModern, gute Komprimierung50 MB
BMP.bmpUnkomprimiert50 MB
TIFF.tiff, .tifHohe Qualität50 MB
HEIC.heiciPhone-Fotos50 MB
AVIF.avifFormat der nächsten Generation50 MB
JP2.jp2JPEG 200050 MB
DNG.dngKamera-Rohdaten50 MB
MPO.mpoMehrbildobjekt50 MB

Unterstützte Video-Codecs#

Die Dateierweiterung allein reicht nicht aus: Ein Video kann trotzdem nicht verarbeitet werden, wenn sein Codec während der Verarbeitung nicht decodiert werden kann.

H.264-MP4 verwenden

H.264-Videos in einem MP4-Container werden von den meisten Decodern unterstützt und sind die sicherste Wahl. Wenn ein Video nicht verarbeitet werden kann, codiere es mit FFmpeg neu:

ffmpeg -i input.mov \
  -c:v libx264 -pix_fmt yuv420p \
  -c:a aac -movflags +faststart \
  output.mp4

Datensatz vorbereiten#

Platform unterstützt Ultralytics YOLO, COCO, LabelMe JSON, semantische PNG-Masken, Tiefendatensätze, Ultralytics NDJSON und Labelbox NDJSON sowie Uploads ohne Annotationen:

Verwende die standardmäßige YOLO-Ordnerstruktur mit einer data.yaml-Datei:

my-dataset/
├── images/
│   ├── train/
│   │   ├── img001.jpg
│   │   └── img002.jpg
│   └── val/
│       ├── img003.jpg
│       └── img004.jpg
├── labels/
│   ├── train/
│   │   ├── img001.txt
│   │   └── img002.txt
│   └── val/
│       ├── img003.txt
│       └── img004.txt
└── data.yaml

Die YAML-Datei legt die Konfiguration deines Datensatzes fest:

# data.yaml
path: .
train: images/train
val: images/val

names:
    0: person
    1: car
    2: dog
Uploads ohne Annotationen

Ohne Annotationen: Lade unbeschriftete Bilder hoch (ohne Labels). Das ist nützlich, wenn du die Bilder direkt auf der Plattform mit dem Annotationseditor beschriften möchtest.

Flache Verzeichnisstruktur

Du kannst Bilder auch ohne explizite Ordner für die Aufteilungen hochladen. Platform berücksichtigt beim Upload die aktive Zielaufteilung. Ist kein Ziel für die Aufteilung festgelegt und bleibt val nach dem Upload leer – oder enthält der Datensatz für Tiefen weniger als zwei zugeordnete Karten –, verschieben Datensätze, die keine Klassifizierungsdatensätze sind, Trainingsbilder automatisch nach val, sodass sie sofort trainiert werden können. Klassifizierungsdatensätze werden übersprungen, da sie Aufteilungen anhand von Verzeichnissen verwenden. Du kannst Bilder jederzeit später über Massenverschiebung in eine Aufteilung oder Neuverteilung der Aufteilungen neu zuordnen.

Automatische Formaterkennung

Das Format wird automatisch erkannt: Datensätze mit einem data.yaml, das die Schlüssel names, train oder val enthält, werden als YOLO behandelt. Datensätze mit COCO-JSON-Dateien, die die Arrays images, annotations und categories enthalten, werden als COCO behandelt. Ohne COCO-Datei werden JSON-Dateien von LabelMe für einzelne Bilder, die shapes und imagePath enthalten, als LabelMe-Annotationen eingelesen. .ndjson-Exporte werden als Ultralytics-NDJSON importiert oder als Labelbox-Exporte, wenn ihre Zeilen einen data_row-Schlüssel enthalten. Datensätze, die nur Bilder und keine Annotationen enthalten, werden als Rohdaten behandelt.

Wenn ein Archiv mehrere YAML-Dateien enthält, bevorzugt die Plattform standardisierte Dateinamen (data.yaml, data.yml, dataset.yaml, dataset.yml), die sich möglichst nahe am Stammverzeichnis des Archivs befinden. Verwende pro Archiv eine eindeutig benannte YAML-Datei, um Mehrdeutigkeiten zu vermeiden.

Pascal-VOC-XML wird nicht importiert

Labeldateien im Pascal-VOC-XML-Format werden erkannt, ihre Annotationen werden jedoch nicht importiert – die Bilder werden ohne sie hochgeladen. Außerdem erhalten fünf oder mehr Bilder in einem Ordner wie images/ oder JPEGImages/ eine nach diesem Ordner benannte Klasse. Die Plattform warnt dich, bevor der Upload beginnt („Pascal-VOC-Labels erkannt“). Wandle VOC XML zunächst in YOLO oder COCO um; siehe Tools zur Formatkonvertierung.

Wenn Labels Klassen-IDs enthalten, aber keine Klassennamen angegeben sind, ordnet die Plattform die IDs einer lückenlosen, bei 0 beginnenden Folge neu zu und benennt jede Klasse nach ihrer ursprünglichen ID (class0, class3, …). Die Namen kannst du später im Tab „Klassen“ ändern.

Details zu den einzelnen Formaten findest du unter unterstützte Aufgaben und in der Übersicht über Datensätze.

Uploadvorgang#

So erstellst du einen Datensatz:

  1. Navigiere in der Seitenleiste zu Annotate
  2. Klicke auf New Dataset
  3. Wähle einen Tab für die Datenquelle aus (siehe unten Datenquellen)
  4. Gib einen Namen ein – der URL-Teil wird automatisch abgeleitet und kann bearbeitet werden – sowie optional eine Beschreibung
  5. Wähle den Aufgabentyp (siehe unterstützte Aufgaben), optional eine Lizenz (siehe verfügbare Lizenzen) und die Sichtbarkeit (öffentlich oder privat). Für einen neuen öffentlichen Datensatz ist CC BY 4.0 vorausgewählt. Wähle eine andere Lizenz oder None, um die Auswahl zu ändern
  6. Klicke für lokale Dateien auf Create & Upload, für eine URL oder verbundene Quelle auf Create & Import oder auf Create Dataset, um mit einem leeren Datensatz zu beginnen

Ultralytics-Plattform: Aufgabenauswahl im Dialog zum Hochladen von Datensätzen

Um Dateien zu einem bestehenden Datensatz hinzuzufügen, öffne die Datensatzseite und ziehe die Dateien entweder in die Galerie oder klicke auf das Upload-Symbol in der Kopfzeile der Seite. Das Upload-Symbol öffnet direkt die native Dateiauswahl deines Browsers, da die Aufgabe des Datensatzes bereits festgelegt ist.

Datenquellen#

Der Dialog New Dataset bietet vier Quellen:

QuelleBeschreibung
HochladenZiehe Dateien hierher oder suche nach ihnen – Bilder, Videos, Archive oder NDJSON
URLFüge einen direkten Link zu einer Datei vom Typ .zip, .tar, .tar.gz, .tgz oder .ndjson ein. Die Plattform lädt die Datei serverseitig herunter und verarbeitet sie.
CloudNutze Daten direkt von Google Cloud Storage, Amazon S3 oder Azure Blob Storage (Pro und Enterprise)
Vor OrtErstelle Indizes und trainiere mit Daten, die deine Geräte nie verlassen, mithilfe von On Premise-Workern (Enterprise)

Datensätze mit Tiefendaten können nur über Upload oder URL erstellt werden; die Tabs Cloud und On Premise sind für die Tiefenaufgabe deaktiviert.

Beschränkungen für URL-Importe

Für einen URL-Import gilt sowohl das Upload-Limit deines Tarifs (10 GB Free / 20 GB Pro / 50 GB Enterprise) als auch dein verbleibendes Speicherkontingent – maßgeblich ist der jeweils niedrigere Wert. Der Link muss über HTTP oder HTTPS öffentlich erreichbar sein und mit einer unterstützten Dateiendung enden.

Vor dem Upload#

Die Plattform überprüft deine Dateien im Browser, bevor sie etwas hochlädt. So werden häufige Probleme sofort und nicht erst nach einer langen Übertragung erkannt. Archive werden auf Beschädigungen, leeren Inhalt, Passwortschutz und YAML-Syntaxfehler geprüft; zu große Dateien werden namentlich aufgeführt.

Danach können zwei Dialoge erscheinen:

Wenn ein ZIP-Archiv Klassennamen enthält und dein Datensatz bereits Klassen hat, zeigt das Dialogfeld Map classes eine Zeile pro eingehender Klasse an. Ordne jede Klasse einer vorhandenen Klasse zu oder erstelle eine neue Klasse. Alternativ kannst du das Kontrollkästchen Einschließen deaktivieren, um die Klasse zu überspringen. Übereinstimmende Namen werden vorausgewählt (Groß- und Kleinschreibung wird ignoriert, außer bei Namen mit einem oder zwei Zeichen). Anmerkungen übersprungener Klassen werden nicht importiert.

Nach dem Upload verarbeitet die Plattform deine Daten automatisch:

  1. Validierung: Prüfung von Format und Größe
  2. Normalisierung: Große Bilder werden verkleinert (maximal 4096 px, kürzeste Seite mindestens 28 px), Graustufenbilder in RGB umgewandelt, Transparenz mit weißem Hintergrund zusammengeführt und die EXIF-Ausrichtung angewendet. TIFF-Originale werden wie hochgeladen gespeichert.
  3. Miniaturansichten: WebP-Vorschauen mit 256 px werden erstellt
  4. Auswertung von Beschriftungen: YOLO, COCO, LabelMe sowie extrahierte NDJSON-Beschriftungen von Ultralytics oder Labelbox
  5. Statistiken: Klassenverteilungen und Bildabmessungen werden berechnet
Kodierung gespeicherter Bilder

TIFF-Originale werden immer bytegenau gespeichert. AVIF- und WebP-Originale werden ebenfalls unverändert gespeichert, wenn keine Größenänderung oder Farbänderung erforderlich ist. Alle anderen Dateien werden neu kodiert: WebP-Quellen bleiben WebP; alle übrigen Quellen (JPEG, PNG, BMP, HEIC, JP2, DNG, MPO sowie verkleinerte oder farblich veränderte AVIF-Dateien) werden mit Qualität 92 als JPEG gespeichert. Der ursprüngliche Dateiname und die ursprüngliche Dateiendung bleiben als Metadaten erhalten.

Ultralytics-Plattform: Fortschrittsbalken beim Hochladen von Datensätzen

Vor dem Upload validieren

Du kannst deinen Datensatz lokal validieren, bevor du ihn hochlädst:

from ultralytics.data.utils import check_det_dataset

check_det_dataset("path/to/data.yaml")
Anforderungen an die Bildgröße

Bilder müssen an ihrer kürzesten Seite mindestens 28 px groß sein. Kleinere Bilder werden bei der Verarbeitung abgelehnt. Bilder, deren längste Seite größer als 4096 px ist, werden automatisch unter Beibehaltung des Seitenverhältnisses verkleinert. TIFF-Originale sind davon ausgenommen und werden wie hochgeladen gespeichert.

Bilder durchsuchen#

Sieh dir die Bilder deines Datensatzes in verschiedenen Layouts an.

Öffne das Clustering-Panel über die Werkzeugleiste der Galerie, um deinen Datensatz als interaktives 2D-Streudiagramm zu erkunden.

AnsichtBeschreibung
RasterRaster mit Miniaturansichten und Annotationseinblendungen (Standard)
KompaktKleinere Miniaturansichten zum schnellen Durchsehen
TabelleListe mit Miniaturansicht, Dateiname, Abmessungen, Größe, Datensatzaufteilung, Klassen und Anzahl der Labels

Ultralytics-Plattform: Rasteransicht der Datensatzgalerie mit Annotationen

Sortieren und filtern#

Bilder lassen sich effizient sortieren und filtern:

Jede Option wechselt zwischen aufsteigender (↑) und absteigender (↓) Sortierung:

Sortieren nachBeschreibung
Erstellt ↑/↓Upload-Reihenfolge (Standard: ↓)
Name ↑/↓Dateiname alphabetisch
Höhe ↑/↓Bildhöhe in Pixeln
Breite ↑/↓Bildbreite in Pixeln
Größe ↑/↓Dateigröße auf dem Datenträger
Annotationen ↑/↓Anzahl der Annotationen pro Bild
Große Datensätze

Bei Datensätzen mit mehr als 100.000 Bildern werden die Sortieroptionen für Name, Breite, Höhe und Größe ausgeblendet, damit die Galerie reaktionsfähig bleibt. Die Sortierung nach Erstellungszeitpunkt und Anzahl der Annotationen ist weiterhin verfügbar.

Nicht gelabelte Bilder finden

Setze den Filter Annotations auf Unannotated, um schnell Bilder zu finden, die noch annotiert werden müssen. Das ist besonders bei großen Datensätzen hilfreich, wenn du den Fortschritt der Labelvergabe verfolgen möchtest.

Bilder durchsuchen

Das Suchfeld befindet sich rechts in der Werkzeugleiste der Galerie und filtert alle Ansichtsmodi – Raster, kompakt und Tabelle. Es sucht nach dem Dateinamen des Bildes (die Dateiendung ist optional), dem Namen jeder im Bild annotierten Klasse sowie nach benutzerdefinierten Metadatenschlüsseln, Einzelwerten und Array-Einträgen. Ein Bild namens img_0042 mit einer Annotation boat und den Metadaten {"ship_type": "yacht"} findest du daher mit der Suche nach img_0042, boat oder yacht.

Werte in verschachtelten Unterobjekten werden nicht abgeglichen. Wenn du eine 24 Zeichen lange Bild-ID oder einen 32 Zeichen langen Inhalts-Hash einfügst, wird genau dieses Bild direkt gesucht und die Textsuche umgangen.

Die Ergebnisse werden nach Relevanz sortiert: Zuerst erscheinen Bilder, deren Dateiname, Klasse oder Metadaten übereinstimmen, gefolgt von bis zu 1.000 weiteren Bildern, die der Suche ähneln, etwa forklift near a doorway. Während eine Suche aktiv ist, ist die Sortierung nicht verfügbar. Endet eine Suchanfrage mit einer Dateierweiterung, werden die ähnlichen Bilder nicht berücksichtigt.

Vollbildanzeige#

Klicke auf ein beliebiges Bild, um es in der Vollbildanzeige zu öffnen. Dort hast du folgende Möglichkeiten:

  • Navigation: Mit den Pfeiltasten oder Miniaturansichten blättern
  • Bildinformationen: Von der Plattform erzeugte Eigenschaften, benutzerdefinierte Metadaten und eingebettete Dateimetadaten wie EXIF prüfen
  • Benutzerdefinierte Metadaten: Eigentümer und Bearbeiter können ein JSON-Objekt hinzufügen oder ersetzen, einschließlich verschachtelter Werte mit bis zu 500.000 serialisierten Zeichen und oberster Schlüssel mit bis zu 128 Zeichen
  • Annotationen: Sichtbarkeit der Annotationseinblendung umschalten
  • Klassenaufschlüsselung: Anzahl der Labels pro Klasse mit Farbanzeigen
  • Annotieren: Wenn du Bearbeitungszugriff hast, sind die Steuerelemente für Annotationen sofort aktiv, sobald der Vollbild-Viewer auf dem Desktop geöffnet wird
  • Gesichter weichzeichnen: Klicke mit der rechten Maustaste auf eine Annotation, um die Gesichtsunschärfe in der Vorschau anzuzeigen und anzuwenden, sofern dies für das Bild verfügbar ist
  • Herunterladen: Originalbilddatei herunterladen
  • Löschen: Bild aus dem Datensatz löschen
  • Zoom: Mit Cmd/Ctrl+Scroll, Cmd/Ctrl++ oder Cmd/Ctrl+= vergrößern und mit Cmd/Ctrl+- verkleinern
  • Ansicht zurücksetzen: Mit Cmd/Ctrl + 0 oder der Schaltfläche zum Zurücksetzen das Bild an den Viewer anpassen
  • Verschieben: Halte Space gedrückt und ziehe, oder ziehe mit der mittleren Maustaste, um die Arbeitsfläche bei jeder Zoomstufe zu verschieben
  • Pixelansicht: Pixelige Darstellung für eine genaue Betrachtung umschalten
  • Tiefenblende: Bei Tiefendatensätzen wechselt ein verschiebbarer Trenner zwischen dem RGB-Bild und seiner farbigen Tiefenkarte

Vollbild-Viewer für Datensätze der Ultralytics Platform mit Metadatenbereich

Nach Aufteilung filtern#

Bilder nach ihrer Datensatzaufteilung filtern:

AufteilungZweck
TrainierenWird für das Modelltraining verwendet
ValidierungWird während des Trainings zur Validierung verwendet
TestWird für die abschließende Auswertung verwendet

Clustering#

Der Bereich Clustering stellt deinen Datensatz als interaktives 2D-Streudiagramm dar, in dem sich visuell ähnliche Bilder nahe beieinander befinden. Nutze ihn, um Cluster aufzudecken, Duplikate und Ausreißer zu erkennen und zu prüfen, wie Aufteilungen oder Klassen in deinen Daten verteilt sind – ohne die Galerie zu verlassen. Öffne ihn über das Streudiagramm-Symbol in der Symbolleiste der Galerie auf einer beliebigen Datensatzseite. Der Bereich ist nur auf dem Desktop verfügbar; Betrachter ohne Bearbeitungszugriff sehen das Symbol, sobald der Datensatz analysiert wurde.

Leerer Zustand der Clusteransicht für Datensätze der Ultralytics Platform

Analyse wird ausgeführt#

Analyse starten:

  1. Öffne einen Datensatz und klicke auf das Streudiagramm-Symbol in der Symbolleiste der Galerie
  2. Klicke auf Analyze Dataset
  3. Warte, bis der Fortschrittsbalken abgeschlossen ist – die Ergebnisse erscheinen im selben Bereich

Die Analyse läuft im Hintergrund in zwei Phasen, Computing embeddings und Clustering, und kann je nach Größe deines Datensatzes einige Minuten dauern. Du kannst den Bereich schließen oder die Seite verlassen und später zurückkehren.

Analysevoraussetzungen

Ein Datensatz muss mindestens 20 und höchstens 200.000 fehlerfreie Bilder enthalten, um analysiert werden zu können. Verbundene Datensätze, die Cloud- oder On-Premise-Speicher verwenden, werden derzeit nicht unterstützt.

Visualisierung#

Nach Abschluss der Analyse zeigt der Bereich ein 2D-Streudiagramm aller analysierten Bilder mit einer Legende und einem Punktzähler. Galerie-Filter (Aufteilung, Klasse, beschriftet/unbeschriftet) blenden nicht passende Punkte ab, damit du dich auf die gewünschte Teilmenge konzentrieren kannst – der Zähler zeigt dann visible / total points an.

Streudiagramm der Clusteransicht für Datensätze der Ultralytics Platform

Einfärben nach#

Ändere die Schattierung der Datenpunkte über das Dropdownmenü Color by in der Symbolleiste des Bereichs. Wechsle jederzeit zwischen den Ansichtsmodi – das Diagramm wird sofort neu eingefärbt, damit du sehen kannst, wie Aufteilungen, Klassen oder Bildeigenschaften über deine Cluster verteilt sind:

OptionSchattierung
AufteilungenTraining / Validierung / Test
KlassenErste Annotationsklasse auf jedem Bild
ClusterVisuelle Insel im Layout, beginnend mit der größten; Verstreut für Punkte außerhalb jeder Insel, Nicht berechnet für Layouts, die analysiert wurden, bevor diese Option verfügbar war
BreiteBildbreite
HöheBildhöhe
GrößeDateigröße
AnnotationenAnzahl der Annotationen pro Bild

Farbmodi der Clusteransicht für Datensätze der Ultralytics Platform

Auswahl mit Lasso und Klick#

Ziehe eine Freiformauswahl um einen Bereich, um die Punkte im Diagramm hervorzuheben, oder klicke auf einen Punkt, um alle Punkte derselben Farbe auszuwählen (beim Einfärben nach Breite, Höhe, Größe oder Annotationen wird nur dieser Punkt ausgewählt); klicke auf eine leere Stelle im Diagramm, um die Auswahl aufzuheben. Die Galerie wird auf die passenden Bilder gefiltert, sodass du sie mit den üblichen Bildaktionen prüfen, neu beschriften, verschieben oder löschen kannst.

Auswahl aufheben

Ein Feld oberhalb des Diagramms zeigt die Anzahl der ausgewählten Punkte an – klicke auf × oder eine leere Stelle im Diagramm, um die Auswahl aufzuheben und zur vollständigen Galerieansicht zurückzukehren.

Auswahlgröße

Eine Auswahl per Lasso oder Klick umfasst höchstens 1.000 Bilder. Wenn deine Auswahl mehr Bilder enthält, zeigt Platform eine Stichprobe von 1.000 Bildern an und schlägt vor, einen kleineren Bereich auszuwählen.

Verschieben und Zoomen#

Navigiere mit Maus und Tastatur oder über die Zoom-Schaltflächen unten links im Diagramm durch große Streudiagramme:

EingabeAktion
ScrollenDiagramm in 2D verschieben
Cmd/Ctrl+ScrollenAm Cursor verankert hinein- oder herauszoomen
Leertaste gedrückt haltenZum Verschieben durch Ziehen wechseln
Zurücksetzen-SchaltflächeZur vollständigen Ausdehnung des Diagramms zurückkehren

Erneute Analyse#

Wenn sich dein Datensatz nach der Analyse ändert – neue Bilder hinzukommen oder die analysierte Anzahl nicht mehr mit dem Datensatz übereinstimmt – oder die Analyse vor der Farboption Cluster durchgeführt wurde, erscheint oben im Bereich für Eigentümer und Bearbeiter eine Schaltfläche Re-analyze.

Klicke auf Re-analyze, um die Einbettungen und die 2D-Projektion von Grund auf neu zu berechnen.

Ähnliche Bilder finden#

Dieselben Einbettungen ermöglichen die Ähnlichkeitssuche in öffentlichen Datensätzen sowie in deinen eigenen und Teamdatensätzen. Klicke in einem Datensatz, den du bearbeiten kannst, in der Ansicht Raster oder Kompakt mit der rechten Maustaste auf ein Bild (oder wähle in der Ansicht Tabelle eine einzelne Zeile aus) und wähle Ähnliche Bilder finden. Der Dialog zeigt das Quellbild neben bis zu 24 der ähnlichsten Bilder an, jeweils mit ihrem Ähnlichkeitswert. Bilder, die bereits in deinem Datensatz enthalten sind, sowie Kopien des ausgewählten Bildes in anderen Datensätzen werden ausgeschlossen. Klicke auf ein Bild, um eine Vorschau in voller Größe sowie den Quelldatensatz, die Lizenz und den Ähnlichkeitswert anzuzeigen. Wähle Bilder über ihre Kontrollkästchen (oder alle Bilder) aus und klicke dann auf N zum Datensatz hinzufügen: Die Bilder werden der Aufteilung train als unbeschriftete Bilder hinzugefügt, auf deinen Speicher angerechnet und sind bereit für die Annotation.

Dialog zum Finden ähnlicher Bilder in Datensätzen der Ultralytics Platform

Ein Bild ohne Einbettung – in einem noch nicht analysierten Datensatz oder seit der letzten Analyse hinzugefügt – wird beim Öffnen des Dialogs eingebettet. Du musst also nicht zuerst eine Clusteranalyse ausführen. Der Dialog ist für verbundene Datensätze nicht verfügbar. Die Validierungsdiagnose pro Bild eines Modells führt dieselbe Suche anhand der Bilder mit der schlechtesten Leistung aus.

Dataset-Tabs#

Je nach Zustand des Datensatzes und deinen Berechtigungen können auf jeder Datensatzseite bis zu sechs Tabs angezeigt werden:

Tab „Bilder“#

Die Standardansicht mit der Bildergalerie und den Annotationseinblendungen. Unterstützt die Ansichtsmodi Raster, Kompakt und Tabelle. Ziehe Dateien per Drag-and-drop hierher, um weitere Bilder hinzuzufügen.

Tab „Klassen“#

Dieser Tab wird angezeigt, wenn der Datensatz Bilder enthält und für seine Aufgabe Klassen definiert sind.

Verwalte die Annotationsklassen deines Datensatzes:

  • Klassenhistogramm: Balkendiagramm mit der Anzahl der Annotationen pro Klasse, nach Häufigkeit sortiert, mit Umschaltung zwischen linearer und logarithmischer Skala
  • Klassentabelle: Sortier- und durchsuchbare Tabelle mit Index, Name, Anzahl der Annotationen und Anzahl der Bilder
  • Klassennamen bearbeiten: Klicke auf einen Klassennamen, um ihn direkt umzubenennen
  • Klassenfarben bearbeiten: Klicke auf ein Farbfeld, um die Klassenfarbe zu ändern
  • Neue Klasse hinzufügen: Füge über das Eingabefeld unten Klassen hinzu
  • Klassen zusammenführen: Wähle mindestens zwei Zeilen aus und klicke auf Merge into one
  • Klassen löschen: Wähle mindestens eine Zeile aus und klicke auf Delete

Klassen-Tab mit Histogramm und Tabelle für Datensätze der Ultralytics Platform

Logarithmische Skala für unausgewogene Datensätze

Wenn dein Datensatz unausgewogene Klassen enthält (z. B. 10.000 Annotationen für „Person“, aber nur 50 für „Fahrrad“), aktiviere die Umschaltoption Log Scale im Klassenhistogramm, um alle Klassen übersichtlich darzustellen.

Klassen zusammenführen#

Beim Zusammenführen werden doppelte oder überlappende Labels zusammengefasst – beispielsweise car, automobile und vehicle zu einer Klasse:

  1. Wähle über die Kontrollkästchen der Zeilen mindestens zwei Klassen aus
  2. Klicke in der Tabellenkopfzeile auf Merge into one oder klicke mit der rechten Maustaste auf die Auswahl
  3. Wähle aus den markierten Klassen die Zielklasse, in die die anderen Klassen zusammengeführt werden
  4. Bestätige

Jede Annotation der Quellklassen wird der Zielklasse zugewiesen, und die Quellklassen werden entfernt. Es werden keine Annotationen gelöscht, daher bleibt die Gesamtzahl der Annotationen im Datensatz unverändert.

Klassen löschen#

  1. Wähle über die Kontrollkästchen der Zeilen mindestens eine Klasse aus
  2. Klicke in der Tabellenkopfzeile auf Delete oder klicke mit der rechten Maustaste auf die Auswahl
  3. Bestätige

Beim Löschen einer Klasse werden die Klasse und alle zugehörigen Annotationen entfernt. Bei Klassifizierungsdatensätzen werden die Labels entfernt, die Bilder bleiben jedoch erhalten und sind anschließend nicht annotiert.

Klassenindizes verschieben sich

Klassen-IDs sind positionsabhängig. Wenn du eine Klasse zusammenführst oder löschst, rückt jeder höhere Klassenindex nach unten, um die Lücke zu schließen. Exporte und Labeldateien, die vor der Änderung erstellt wurden, stimmen daher nicht mehr mit den neuen Indizes überein. Erstelle zuerst eine Version, wenn du die alte Nummerierung benötigst.

Statistikstichprobe

Klassenanzahlen werden für höchstens 100.000 Bilder berechnet. Bei größeren Datensätzen steht über dem Histogramm der Hinweis „Basiert auf einer Teilmenge dieses Datensatzes mit 100.000 Bildern.“

Registerkarte „Diagramme“#

Diese Registerkarte wird angezeigt, wenn der Datensatz Bilder enthält.

Automatisch aus deinem Datensatz berechnete Statistiken:

Die Diagramme erscheinen in der folgenden Reihenfolge. Ein Diagramm wird ausgelassen, wenn der Datensatz dafür keine Daten enthält – ein Datensatz mit unbeschrifteten Bildern zeigt keine Annotationsdiagramme, und Points per Instance wird nur für Segmentierungs- und Posendaten angezeigt:

DiagrammBeschreibung
Verteilung auf DatensatzaufteilungenRingdiagramm mit der Anzahl der Trainings-, Validierungs- und Testbilder sowie dem Anteil beschrifteter Bilder
Häufigste KlassenRingdiagramm der 10 häufigsten Annotationsklassen; alle übrigen werden als „Sonstige“ zusammengefasst
BildabmessungenHistogramm der Verteilung von Bildbreite und -höhe (überlagert) mit Mittelwert
BilddateigrößeHistogramm der Verteilung der Bilddateigrößen
Bildabmessungen (2D)2D-Heatmap für Breite und Höhe mit Hilfslinien für das Seitenverhältnis
Positionen der Annotationen2D-Heatmap der Mittelpunkte von Begrenzungsrahmen
BildformateVerteilung der Quellbildformate (JPG, PNG usw.)
Abmessungen der BegrenzungsrahmenHistogramm der Breite und Höhe von Begrenzungsrahmen (überlagert)
Objekte pro BildHistogramm der Anzahl von Annotationen pro Bild
Punkte pro InstanzAnzahl der Polygonvertices oder Keypoints pro Annotation (Segmentierung/Posen)

Statistiken im Diagrammraster der Registerkarte „Datensätze“ der Ultralytics Platform

Zwischenspeicherung von Statistiken

Die Platform speichert berechnete Statistiken zwischen und verwirft sie, wenn sich Bilder, Annotationen, Klassen oder Datensatzaufteilungen ändern. Bei Datensätzen mit mehr als 100.000 Bildern werden die Diagramme anhand einer Teilmenge von 100.000 Bildern erstellt; darüber steht ein entsprechender Hinweis.

Heatmaps im Vollbild

Klicke bei einer beliebigen Heatmap auf die Schaltfläche zum Vergrößern, um sie im Vollbildmodus anzuzeigen. So erhältst du eine größere, detailliertere Ansicht – hilfreich, um räumliche Muster in großen Datensätzen zu erkennen.

Registerkarte „Modelle“#

Sieh dir alle Modelle, die mit diesem Datensatz trainiert wurden, in einer durchsuchbaren Tabelle an:

SpalteBeschreibung
ModellÜbergeordnetes Projekt und Modellname mit Links
VersionUnveränderliche Datensatzversion, die für das Training verwendet wurde; wird angezeigt, wenn eines der aufgeführten Modelle eine solche Version verwendet hat
StatusStatuskennzeichnung des Trainings
AufgabeYOLO-Aufgabentyp
EpochenBeste Epoche / Epochen insgesamt
MetrikenZwei zentrale Messwerte für jede Aufgabe in der Tabelle, etwa mAP50 und mAP50-95 bei der Objekterkennung oder Top-1- und Top-5-Genauigkeit
ErstelltErstellungsdatum

Tabelle mit trainierten Modellen in der Registerkarte „Modelle“ unter „Datensätze“ der Ultralytics Platform

Registerkarte „Fehler“#

Diese Registerkarte wird nur angezeigt, wenn mindestens eine Datei nicht verarbeitet werden konnte.

Hier werden Bilder aufgeführt, deren Verarbeitung fehlgeschlagen ist:

  • Fehlerhinweis: Gesamtzahl der Bilder, deren Verarbeitung fehlgeschlagen ist, und entsprechende Hinweise
  • Fehlertabelle: Dateiname, verständliche Fehlerbeschreibung, Hinweise zur Behebung und Vorschaubild
  • Häufige Fehler sind beschädigte Dateien, nicht unterstützte Formate, zu kleine Bilder (mindestens 28 px erforderlich) und nicht unterstützte Farbmodi

Verarbeitungsfehler in der Registerkarte „Fehler“ unter „Datensätze“ der Ultralytics Platform

Häufige Verarbeitungsfehler
FehlerUrsacheBehebung
Bilddatei kann nicht gelesen werdenBeschädigtes oder nicht unterstütztes FormatErneut aus dem Bildbearbeitungsprogramm exportieren
Unvollständig oder beschädigtDatei wurde während der Übertragung abgeschnittenOriginaldatei erneut herunterladen
Nicht unterstütztes BildformatFormat, das die Platform nicht dekodieren kannIn JPG, PNG oder WebP konvertieren
DateiberechtigungsfehlerDatei ist gesperrt oder schreibgeschütztDatei entsperren und erneut hochladen
Bild zu kleinKleinste Abmessung unter 28 pxQuellbilder mit höherer Auflösung verwenden
Nicht unterstützter FarbmodusCMYK- oder indizierter FarbmodusIn den RGB-Modus konvertieren

Registerkarte „Versionen“#

Erstelle unveränderliche NDJSON-Momentaufnahmen deines Datensatzes, um reproduzierbares Training zu ermöglichen. Jede Version erfasst zum Zeitpunkt ihrer Erstellung die Bildanzahl, Klassenanzahl, Annotationsanzahl und den hinzugefügten Speicherplatz.

SpalteBeschreibung
VersionVersionsnummer (v1, v2, …)
BeschreibungVom Benutzer eingegebene Beschreibung (bearbeitbar)
BilderBildanzahl zum Zeitpunkt der Momentaufnahme
KlassenKlassenanzahl zum Zeitpunkt der Momentaufnahme
AnnotationenAnnotationsanzahl zum Zeitpunkt der Momentaufnahme
GrößeVon dieser Version hinzugefügter Speicherplatz
ErstelltErstellungszeitpunkt der Version
AktionenVergleichen, herunterladen oder wiederherstellen

So erstellst du eine Version:

  1. Öffne die Registerkarte Versionen
  2. Gib optional eine Beschreibung ein (z. B. „500 Trainingsbilder hinzugefügt“ oder „Falsch zugewiesene Klassen korrigiert“)
  3. Klicke auf Neue Version
  4. Die neue Version wird in der Tabelle angezeigt. Wenn der Datensatz mit einer vorhandenen Version übereinstimmt, etwa direkt nach einer Wiederherstellung, wird diese Version wiederverwendet und erhält die neue Beschreibung, falls du eine eingegeben hast.

Jede Version erhält fortlaufend eine Nummer (v1, v2, v3 …) und ist unveränderlich – Versionen können weder bearbeitet noch gelöscht werden; nur ihre Beschreibungen lassen sich ändern. Über die Aktionen in der Zeile kannst du jederzeit eine Version herunterladen oder wiederherstellen.

Versionen vergleichen#

Klicke bei einer beliebigen Version nach v1 auf das Vergleichssymbol, um zu sehen, was sich seit einer früheren Version geändert hat. Versionen vergleichen beginnt mit der vorherigen Version; wähle im Menü Von eine andere Version aus. Die unter Bilder, Anmerkungen, Klassen und Einstellungen gruppierten Markierungen geben die Anzahl der hinzugefügten, entfernten, geänderten und in eine andere Aufteilung verschobenen Bilder sowie der hinzugefügten und entfernten Anmerkungen an. Außerdem nennen sie die hinzugefügten, entfernten oder umbenannten Klassen und alle geänderten Datensatzeinstellungen. Jedes geänderte Bild wird mit seinem Abzeichen aufgelistet. Wähle ein Bild aus, um es Vorher und Nachher zu sehen. Auf beiden Seiten werden die Beschriftungen angezeigt, die in der jeweiligen Version gespeichert waren. Wenn sich die Metadaten eines Bildes geändert haben, führt Metadatenänderungen jeden hinzugefügten, entfernten oder geänderten Schlüssel mit seinem Wert in beiden Versionen auf. Wenn Bilder, ihre Metadaten und Anmerkungen identisch sind, meldet der Dialog Keine Änderungen oder Keine Bildänderungen, wenn sich nur Klassendefinitionen oder Datensatzeinstellungen unterscheiden.

Version wiederherstellen

Beim Wiederherstellen werden die aktuellen Bilder, Datensatzaufteilungen, Klassen und Annotationen des Datensatzes durch die ausgewählte Momentaufnahme ersetzt. Dieser Vorgang kann nicht rückgängig gemacht werden, es sei denn, du speicherst vorher den aktuellen Zustand als weitere Version. Während der Neuerstellung ist der Datensatz im Status processing gesperrt. Beim Wiederherstellen werden keine Dateien erneut hochgeladen, daher geht der Vorgang selbst bei großen Datensätzen in der Regel schnell.

Während des Trainings eine Version speichern

Aktiviere Datensatzversion speichern im Dialogfeld für Cloud-Training, um ein Modell mit genau dem Datensatz zu verknüpfen, der für das Training verwendet wurde. Die Platform verwendet eine übereinstimmende Version erneut, wenn sich der Datensatzinhalt nicht geändert hat, und erstellt nur dann eine neue Version, wenn Änderungen vorliegen.

Nur für bereite Datensätze

Versionen lassen sich erst erstellen und wiederherstellen, wenn der Datensatz den Status ready erreicht hat. Für verbundene Cloud-Datensätze und lokal installierte Datensätze sind keine Versionen verfügbar.

Wann Versionen erstellt werden sollten

Erstelle vor und nach größeren Änderungen an deinem Datensatz eine Version – etwa wenn du Bilder hinzufügst, Anmerkungen korrigierst oder die Aufteilung neu ausbalancierst. So kannst du die Modellleistung über verschiedene Zustände des Datensatzes hinweg vergleichen.

Versionsgröße

Die angezeigte Größe gibt den komprimierten Snapshot-Speicherplatz an, den die Version belegt: Bilddatensätze (URLs, Aufteilungen, Anmerkungen und Metadaten) sowie Einstellungen des Datensatzes, nicht die Bildpixel. Snapshot-Daten, die sich seit einer früheren Version nicht geändert haben, werden gemeinsam genutzt und der Version zugerechnet, in der sie erstmals gespeichert wurden. Die eigentlichen Bilddaten werden separat gespeichert und über signierte URLs abgerufen. Der Snapshot-Speicherplatz wird auf dein Speicherkontingent im Workspace angerechnet. Wenn kein Speicherplatz mehr verfügbar ist, kann daher keine neue Version erstellt werden; eine passende Version wiederzuverwenden ist hingegen möglich.

Datensatz exportieren#

Exportiere deinen Datensatz zur Offline-Nutzung als NDJSON-Datei über die Kopfzeile des Datensatzes oder den Tab „Versionen“.

So exportierst du:

  1. Klicke in der Kopfzeile des Datensatzes auf die Schaltfläche Herunterladen (Download-Symbol).
  2. Lade den aktuellen NDJSON-Snapshot direkt herunter.
  3. Verwende den Tab Versionen, wenn du einen unveränderlichen, nummerierten Snapshot erstellen möchtest, den du später erneut herunterladen kannst.

NDJSON-Download zum Exportieren von Datensätzen in Ultralytics Platform

Das NDJSON-Format speichert pro Zeile ein JSON-Objekt. Die erste Zeile enthält Metadaten zum Datensatz, danach folgt eine Zeile pro Bild:

{"type": "dataset", "task": "detect", "name": "my-dataset", "description": "...", "bytes": 12345678, "url": "https://platform.ultralytics.com/...", "class_names": {"0": "person", "1": "car"}, "version": 1, "created_at": "2026-01-15T10:00:00Z", "updated_at": "2026-02-20T14:30:00Z"}
{"type": "image", "file": "img001.jpg", "url": "https://...", "width": 640, "height": 480, "split": "train", "metadata": {"location": {"site": "factory-1"}, "reviewed": true}, "annotations": {"boxes": [[0, 0.5, 0.5, 0.2, 0.3]]}}
{"type": "image", "file": "img002.jpg", "url": "https://...", "width": 1280, "height": 720, "split": "val"}

Das optionale Objekt metadata auf Bildebene bleibt erhalten, wenn eine NDJSON-Datei in Platform importiert wird. Du kannst das Objekt im Vollbild-Informationsbereich des Bildes ansehen oder bearbeiten. Für programmatische Archiv-Uploads akzeptiert die API zum Einlesen von Datensatzdaten die entsprechende Pfadzuordnung imageMetadata.

Pose-Datensätze enthalten außerdem ein Feld kpt_shape in der Kopfzeile des Datensatzes. Wenn das Feld noch nicht festgelegt wurde, wird sein Wert aus den Anmerkungen abgeleitet.

Tiefenexporte geben "task": "depth" und "depth_scale": 1000 in der Datensatzzeile an. Jede Bildzeile enthält ein depth.url für die zugehörige einfache uint16-PNG-Datei. Ultralytics lädt Bild- und Tiefen-URLs gleichzeitig herunter und erstellt eine Trainings-YAML-Datei mit derselben Skala, sodass die NDJSON-Datei direkt an model.train(data=...) übergeben werden kann.

Signierte URLs

Bild-URLs in der exportierten NDJSON-Datei sind signiert und 7 Tage lang gültig. Wenn sich der Datensatz nicht geändert hat, verwendet Platform bis zu 6 Tage lang einen zwischengespeicherten Export. Ein frisch heruntergeladener Export ist daher immer noch mindestens einen Tag gültig. Wenn du früher neue URLs benötigst, ändere den Datensatz oder erstelle eine neue Version.

Datensätze vor Ort

Für vor Ort gehostete Datensätze ist kein Export verfügbar, da deren Bilddaten Platform nie erreichen.

Die vollständige Spezifikation findest du in der Dokumentation zum Ultralytics-NDJSON-Format.

Bildaktionen#

Schnellaktionen#

Klicke mit der rechten Maustaste auf ein Bild in der Ansicht Raster oder Kompakt oder auf eine einzelne ausgewählte Zeile in der Ansicht Tabelle, um Schnellaktionen aufzurufen. Welche Aktionen verfügbar sind, hängt von deinen Bearbeitungsrechten und der Quelle des Datensatzes ab:

AktionBeschreibung
In Aufteilung verschiebenWeise das Bild der Aufteilung Train, Val oder Test zu.
Ähnliche Bilder findenDurchsuche öffentliche Datensätze, deine eigenen Datensätze und Teamdatensätze nach ähnlichen Bildern, die du hinzufügen kannst (siehe Ähnliche Bilder finden).
Ähnliche Bilder generierenErstelle KI-generierte Varianten und füge anschließend die gewünschten hinzu (siehe Ähnliche Bilder generieren).
Gesichter unkenntlich machenMache die im Bild erkannten Gesichter unkenntlich (siehe Gesichter unkenntlich machen).
Kopieren / AusschneidenKopiere das Bild oder schneide es aus, um es in einen anderen Datensatz einzufügen (siehe Bilder kopieren und verschieben).
EinfügenFüge kopierte oder ausgeschnittene Bilder in diesen Datensatz ein. Diese Aktion wird angezeigt, wenn sich Bilder aus einem anderen Datensatz in der Zwischenablage befinden.
HerunterladenLade die Originalbilddatei herunter.
LöschenLösche das Bild aus dem Datensatz.

Kontextmenü für Bildkarten in Ultralytics Platform-Datensätzen

Einzelne Bilder oder mehrere Bilder

Das Bild-Kontextmenü wirkt sich auf das Bild aus, auf das du geklickt hast. Eine Ausnahme ist Einfügen, wodurch die Bilder aus der Zwischenablage hinzugefügt werden. Um mehrere Bilder gleichzeitig zu bearbeiten, verwende die Ansicht Tabelle und wähle die Bilder über die Kontrollkästchen aus.

Mehrere Bilder in eine andere Aufteilung verschieben#

Weise ausgewählte Bilder innerhalb desselben Datensatzes einer anderen Aufteilung zu:

  1. Wechsle zur Ansicht Tabelle.
  2. Wähle Bilder über die Kontrollkästchen aus.
  3. Klicke mit der rechten Maustaste, um das Kontextmenü zu öffnen.
  4. Wähle Move to split > Train, Validation oder Test.

Du kannst Bilder auch per Drag-and-drop auf die Tabs der Aufteilungsfilter in der Rasteransicht ziehen. Wenn ein Bild beim Verschieben mit einem identischen Bild in der Zielaufteilung kollidieren würde, fragt Platform, ob das Bild übersprungen, beibehalten oder ersetzt werden soll.

Trainings- und Validierungsaufteilungen organisieren

Lade alle Bilder in einen Datensatz hoch und verwende dann die Funktion zum Verschieben mehrerer Bilder, um Teilmengen den Trainings-, Validierungs- und Testaufteilungen zuzuweisen.

Aufteilungen neu verteilen#

Verteile alle Bilder anhand eigener Verhältnisse auf die Trainings-, Validierungs- und Testaufteilungen:

  1. Klicke in der Datensatz-Symbolleiste auf den Aufteilungsbalken, um den Dialog Aufteilungen neu verteilen zu öffnen.
  2. Passe die Prozentsätze der Aufteilungen mit einer der folgenden Methoden an.
  3. Prüfe die Live-Vorschau der Bildanzahl, um die Verteilung zu bestätigen.
  4. Klicke auf Anwenden, um alle Bilder anhand deiner Prozentangaben zufällig neu zuzuweisen.

Dialog zum Neuverteilen von Datensatzaufteilungen in Ultralytics Platform

Im Dialog gibt es drei Möglichkeiten, die Zielverhältnisse der Aufteilungen festzulegen:

MethodeBeschreibung
ZiehenZiehe die Griffe zwischen den farbigen Segmenten, um die Grenzen der Aufteilungen visuell anzupassen.
EingebenBearbeite die Prozentangabe für eine beliebige Aufteilung. Die Prozentangaben der beiden anderen Aufteilungen werden automatisch proportional angepasst.
AutomatischMit einem Klick legst du sofort eine Aufteilung von 80/20 für Training und Validierung fest und setzt die Testaufteilung auf 0 %.

Eine Live-Vorschau zeigt genau, wie viele Bilder vor dem Anwenden auf die einzelnen Aufteilungen entfallen.

Schnelle Aufteilung 80/20

Klicke auf die Schaltfläche Automatisch, um sofort die empfohlene Aufteilung von 80/20 für Training und Validierung festzulegen. Dieses Verhältnis wird beim Training am häufigsten verwendet.

Mehrere Bilder löschen#

Lösche mehrere Bilder auf einmal:

  1. Wähle Bilder in der Tabellenansicht aus.
  2. Klicke mit der rechten Maustaste und wähle Delete oder drücke Cmd/Ctrl+Delete.
  3. Bestätige den Löschvorgang.

Bilder kopieren und verschieben#

Kopiere oder verschiebe Bilder aus einem Datensatz, den du bearbeiten kannst, in einen anderen Datensatz – auch in einen Datensatz in einem anderen Workspace:

  1. Klicke im Quelldatensatz in der Ansicht Raster oder Kompakt mit der rechten Maustaste auf ein Bild und wähle Kopieren oder Ausschneiden. Oder wähle Bilder in der Ansicht Tabelle aus und drücke Cmd/Ctrl+C oder Cmd/Ctrl+X. Esc leert die Zwischenablage.
  2. Öffne den Zieldatensatz, klicke mit der rechten Maustaste auf ein Bild und wähle Einfügen, oder drücke Cmd/Ctrl+V.

Eingefügte Bilder behalten ihre Labels und Aufteilungen. Bilder, die sich im selben Split bereits im Zieldatensatz befinden, werden übersprungen. Mit Ausschneiden werden eingefügte Bilder aus dem Quelldatensatz entfernt; mit Kopieren bleibt der Quelldatensatz unverändert. Quell- und Zieldatensatz müssen dieselbe Aufgabe und kompatible Bildkanäle, Einstellungen für Pose-Keypoints und Tiefenskalen haben – auch wenn die kopierten Bilder keine Labels besitzen. Ein leerer Zieldatensatz kann nicht festgelegte Einstellungen für Bildkanäle und Pose übernehmen. Bilder können nicht in einen verbundenen Datensatz eingefügt werden.

Klassen werden anhand ihres Namens abgeglichen. Dabei wird die Groß- und Kleinschreibung ignoriert, außer bei Namen mit einem oder zwei Zeichen. Hat das Ziel keine Klassen, übernimmt es die Klassenliste der Quelle. Wenn ein eingefügtes Bild eine Klasse verwendet, die im Ziel nicht vorhanden ist, fordert dich das Dialogfeld Klassen zuordnen auf, jede solche Klasse einer Datensatzklasse oder einer neuen Klasse zuzuordnen. Alternativ kannst du das Kontrollkästchen Einschließen deaktivieren, um die Beschriftungen dieser Klasse zu verwerfen. Die Bilder werden in jedem Fall eingefügt.

Ähnliche Bilder generieren#

Erstelle neue Trainingsbilder auf Grundlage eines Bildes, das du bereits hast. Klicke in einem Datensatz, den du bearbeiten kannst, in der Ansicht Raster oder Kompakt mit der rechten Maustaste auf ein Bild (oder wähle in der Ansicht Tabelle eine einzelne Zeile aus) und wähle Ähnliche Bilder generieren. Platform beschreibt neue Szenen, die vom Bild inspiriert sind, und generiert jeweils ein Bild. Die Ergebnisse weisen daher ähnliche Motive und einen ähnlichen Stil wie das Ausgangsbild auf, ohne es zu kopieren.

EinstellungBeschreibung
ModellUltralytics Image 4B (Standard) ist am schnellsten; Ultralytics Image 6B hat einen anderen Stil und benötigt mehr Zeit.
Anzahl der BilderAnzahl der zu erstellenden Varianten: 1 bis 16 (Standard: 4).
BildgrößeLängste Kante: 256 bis 2048 px, in Schritten von 64 (Standard: 1024).
AnweisungenOptionale Beschreibung der Aspekte, die geändert oder beibehalten werden sollen, etwa Beleuchtung, Blickwinkel, Hintergrund oder Objekte.

Dialog zum Generieren ähnlicher Bilder in Ultralytics Platform-Datensätzen

Ultralytics Image 9B und Krea 2 Turbo werden ebenfalls aufgeführt, können aber erst ausgewählt werden, wenn du Frühzeitigen Zugriff aktivierst. Krea 2 Turbo ist die langsamste Option. Die ursprünglichen Seitenverhältnisse bleiben erhalten, sofern dies unterstützt wird. Bei sehr schmalen Bildern ist möglicherweise eine größere längste Kante erforderlich. Die Ausgabemaße werden gerundet und auf die unterstützten Größen des Generators beschränkt.

Klicke auf Generieren oder drücke in Anweisungen ⌘/Ctrl+Enter. Die Bilder werden nach ihrer Fertigstellung angezeigt und sind alle ausgewählt. Mit Stoppen wird ein laufender Durchgang beendet; bereits eingegangene Bilder bleiben erhalten. Wenn du andere Anweisungen oder Einstellungen ausprobieren möchtest, ändere sie und klicke auf Weitere generieren: Jeder neue Durchgang erscheint oberhalb der vorherigen, deren Auswahl erhalten bleibt. Klicke auf ein Bild, um es in voller Größe anzusehen, deaktiviere das Kontrollkästchen aller Bilder, die du nicht möchtest, und klicke auf N zum Datensatz hinzufügen. Die beibehaltenen Bilder werden ohne Labels als JPEG-Dateien hochgeladen, nach dem Ausgangsbild benannt, auf deinen Speicherplatz angerechnet und können anschließend annotiert werden. Sie werden dem aktiven Aufteilungsfilter zugewiesen: Wähle vor dem Generieren Train, damit sie train hinzugefügt werden. Wenn Alle ausgewählt ist, gilt die normale Zuweisung beim Hochladen, einschließlich der automatischen Aufteilung für die Validierung, falls erforderlich. Mit Abbrechen werden die Vorschauen verworfen, ohne sie hinzuzufügen. Für generierte Bilder gilt die Einstellung zum Unkenntlichmachen von Gesichtern beim Hochladen des Datensatzes. Die Aktion ist für verbundene Datensätze nicht verfügbar.

Gesichter unkenntlich machen#

Mache die Gesichter in Bildern eines Datensatzes unkenntlich, den du bearbeiten kannst – beispielsweise, um die Privatsphäre der abgebildeten Personen zu schützen. Für verbundene Datensätze und Datensätze mit mehr als drei Bildkanälen ist diese Funktion nicht verfügbar.

  • Ein einzelnes Bild: Klicke in der Ansicht Raster oder Kompakt mit der rechten Maustaste auf das Bild (oder wähle in der Ansicht Tabelle eine einzelne Zeile aus). Alternativ kannst du in der Vollbildansicht mit der rechten Maustaste auf eine Anmerkung klicken. Wähle dann Gesichter unkenntlich machen.
  • Gesamter Datensatz: Öffne auf der Datensatzseite Weitere Aktionen (⋯) und wähle Gesichter unkenntlich machen.

Im Dialog wird zunächst eine Vorschau der erkannten Gesichter in bis zu sechs Bildern (oder im einzelnen Bild) angezeigt, ohne diese zu verändern. Passe Konfidenz (Standard: 0.25) und Rahmenskalierung (0.5–1.5, Standard: 1; damit wird jeder Gesichtsrahmen um seinen Mittelpunkt skaliert) an, um die Vorschau erneut auszuführen. Klicke dann auf Anwenden, um die ursprünglichen Pixel in allen Bildern zu ersetzen, in denen Gesichter erkannt wurden. Bilder ohne erkannte Gesichter bleiben unverändert, Labels und Aufteilungen bleiben erhalten. Da möglicherweise nicht alle Gesichter erkannt werden, solltest du das Ergebnis überprüfen. Durch das Unkenntlichmachen wird nicht automatisch ein Versions-Snapshot erstellt. Das Unkenntlichmachen im gesamten Datensatz kostet 1,00 $ pro 1.000 verarbeitete Bilder, mindestens jedoch 0,01 $ pro Durchlauf (abgerechnet als Automatische Annotation). Der Dialog zeigt den Kostenvoranschlag vor dem Anwenden an; Vorschauen und das Unkenntlichmachen einzelner Bilder sind kostenlos.

Vorschau im Dialog zum Unkenntlichmachen von Gesichtern in Ultralytics Platform-Datensätzen

Um Gesichter in Bildern beim Hochladen unkenntlich zu machen, aktiviere beim Erstellen eines Datensatzes über Hochladen oder URL die Option Gesichter unkenntlich machen oder aktiviere im Dialog Gesichter unkenntlich machen für den gesamten Datensatz die Option Zukünftige Uploads unkenntlich machen. Die Option Zukünftige Uploads unkenntlich machen wird sofort gespeichert, auch wenn du den Dialog schließt, ohne auf Anwenden zu klicken. Später in den Datensatz hochgeladene Bilder werden während der Verarbeitung kostenlos unkenntlich gemacht. Diese Einstellung ändert nichts an Bildern, die sich bereits im Datensatz befinden.

Datensatz-URI#

Verweise mit dem URI-Format ul:// auf Platform-Datensätze (siehe Platform-Datensätze verwenden):

ul://username/datasets/dataset-slug

Du kannst auch direkt eine Web-URL zu einem Datensatz oder Modell einfügen (z. B. https://platform.ultralytics.com/username/datasets/dataset-slug); sie wird automatisch in die URI ul:// umgewandelt. Wenn du eine Liste von Datensätzen übergibst, wird ein Basismodell nacheinander auf jedem Datensatz feinabgestimmt, zum Beispiel model.train(data=["ul://username/datasets/a", "ul://username/datasets/b"]).

Verwende diese URI, um Modelle von überall aus zu trainieren:

export ULTRALYTICS_API_KEY="YOUR_API_KEY"
yolo train model=yolo26n.pt data=ul://username/datasets/my-dataset epochs=100
Mit Platform-Daten überall trainieren

Die URI ul:// funktioniert in jeder Umgebung:

  • Lokaler Rechner: Trainiere auf deiner Hardware; die Daten werden automatisch heruntergeladen
  • Google Colab: Greife in Notebooks auf deine Platform-Datensätze zu
  • Remote-Server: Trainiere auf Cloud-VMs mit vollem Zugriff auf den Datensatz

Verfügbare Lizenzen#

Platform unterstützt die folgenden Lizenzen für Datensätze:

LizenzTyp
KeineKeine Lizenz ausgewählt
CC0-1.0Gemeinfrei
PDM-1.0Gemeinfrei
CC-BY-2.5Freizügig
CC-BY-3.0Freizügig
CC-BY-4.0Freizügig
CC-BY-NC-2.0Nicht kommerziell
CC-BY-NC-3.0Nicht kommerziell
CC-BY-NC-4.0Nicht kommerziell
CC-BY-SA-3.0Copyleft
CC-BY-SA-4.0Copyleft
CC-BY-NC-SA-3.0Copyleft
CC-BY-NC-SA-4.0Copyleft
CC-BY-ND-4.0Keine Bearbeitungen
CC-BY-NC-ND-2.0Nicht kommerziell
CC-BY-NC-ND-4.0Nicht kommerziell
Apache-2.0Freizügig
MITFreizügig
BSD-3-ClauseFreizügig
AGPL-3.0Copyleft
GPL-2.0Copyleft
GPL-3.0Copyleft
LGPL-3.0Copyleft
ODbL-1.0Copyleft
DbCL-1.0Erfordert ODbL
Nur für ForschungszweckeEingeschränkt
SonstigesBenutzerdefiniert
Copyleft-Lizenzen

Wenn du einen Datensatz mit einer Copyleft-Lizenz klonst (AGPL-3.0, GPL-2.0, GPL-3.0, LGPL-3.0, ODbL-1.0, CC-BY-SA-3.0, CC-BY-SA-4.0, CC-BY-NC-SA-3.0, CC-BY-NC-SA-4.0), übernimmt der Klon die Lizenz und die Lizenzeinstellung ist gesperrt.

Sichtbarkeitseinstellungen#

Lege fest, wer deinen Datensatz sehen kann:

EinstellungBeschreibung
PrivatDu und berechtigte Mitglieder des Arbeitsbereichs können darauf zugreifen
ÖffentlichJeder kann den Datensatz ansehen, auch über die Seite „Entdecken“

Die Sichtbarkeit legst du beim Erstellen eines Datensatzes im Dialog New Dataset über einen Umschalter fest. Um sie später zu ändern, klicke in der Breadcrumb-Navigation auf der Seite neben dem Datensatznamen auf das Abzeichen Öffentlich oder Privat; beim Veröffentlichen eines Datensatzes musst du die Änderung bestätigen. On Premise-Datensätze sind immer privat. Öffentliche Datensätze sind auf der Seite Entdecken sichtbar.

Datensatz bearbeiten#

Metadaten des Datensatzes bearbeitest du direkt und inline auf der Datensatzseite – ein Dialog ist nicht erforderlich:

  • Name: Klicke auf den Datensatznamen, um ihn zu bearbeiten. Änderungen werden automatisch gespeichert, sobald das Feld den Fokus verliert oder du Enter verwendest. Namen dürfen höchstens 100 Zeichen lang sein.
  • Beschreibung: Klicke zum Bearbeiten auf die Beschreibung (oder den Platzhalter „Beschreibung hinzufügen …“). Änderungen werden automatisch gespeichert. Beschreibungen dürfen höchstens 1.000 Zeichen lang sein.
  • Aufgabentyp: Klicke auf das Aufgabenabzeichen, um einen anderen Aufgabentyp auszuwählen.
  • Lizenz: Klicke auf die Lizenzeinstellung, um die Lizenz des Datensatzes zu ändern.
  • Symbol: Klicke auf das Datensatzsymbol, um ein eigenes Bild hochzuladen, eines der Bilder des Datensatzes als Symbol festzulegen oder einen Buchstaben und eine Farbe auszuwählen.
Aufgabentyp ändern

Jedes Bild speichert gemeinsam Anmerkungen für alle Aufgabentypen. Wenn du den Aufgabentyp des Datensatzes änderst, legst du fest, welche Anmerkungen im Editor angezeigt und in Exporte und das Training aufgenommen werden. Anmerkungen für andere Aufgabentypen bleiben in der Datenbank erhalten und werden wieder angezeigt, wenn du zurückwechselst. Eine Ausnahme bildet Depth: Die Ground Truth liegt hier als zugehörige Datei und nicht als Anmerkung vor. Daher kann ein Datensatz nur dann zu oder von Depth wechseln, wenn er keine Bilder enthält – importiere ihn stattdessen erneut.

Benutzerdefinierte Metadaten#

Öffne Weitere Aktionen und wähle Informationen, um zwei Bereiche aufzurufen:

  • Ultralytics-Metadaten: schreibgeschützte Platform-Details wie Datensatz-ID, Eigentümer, Aufgabe, Anzahl der Bilder und Anmerkungen, Speicherregion und Zeitstempel
  • Benutzerdefinierte Metadaten: ein eigenes JSON-Objekt für Herkunftsinformationen, Aufnahmebedingungen, Kunden-IDs, Governance oder andere Kontextdaten

Betrachter des Arbeitsbereichs können Metadaten einsehen, während Mitglieder mit Bearbeitungszugriff das benutzerdefinierte Metadatenobjekt ersetzen können. Das serialisierte Metadatenobjekt darf höchstens 500.000 Zeichen umfassen; jeder Schlüssel der obersten Ebene ist auf 128 Zeichen begrenzt. Speichere ein leeres Objekt ({}), um die benutzerdefinierten Metadaten zu löschen.

Datensatz klonen#

Wenn du einen öffentlichen Datensatz ansiehst, der dir nicht gehört, klicke auf Clone Dataset, um den Klondialog zu öffnen. Prüfe den Zielarbeitsbereich, den Namen, die Sichtbarkeit und die Lizenz und bestätige dann den Klonvorgang. Die Kopie umfasst alle Bilder, Anmerkungen und Klassendefinitionen. Öffentliche Quelldatensätze bleiben standardmäßig öffentlich, wenn im Arbeitsbereich die öffentliche Sichtbarkeit voreingestellt ist; Klone in Enterprise-Arbeitsbereichen sind standardmäßig privat. Wenn für den ursprünglichen Datensatz eine Copyleft-Lizenz gilt, übernimmt der Klon diese Lizenz und die Lizenzeinstellung ist gesperrt.

Im Klondialog bleibt Datensatz klonen deaktiviert, wenn die URL im Zielarbeitsbereich bereits verwendet wird. Außerdem muss noch genügend Speicherplatz verfügbar sein, um die Kopie aufzunehmen.

Verbundene Datensätze

Datensätze, die auf Cloud-Speicher oder On Premise-Quellen basieren, können nicht geklont werden, da Platform ihre Bilddaten nicht speichert.

Markieren und teilen#

  • Markieren: Klicke auf die Sternschaltfläche, um einen Datensatz als Lesezeichen zu speichern. Die Anzahl der Sterne ist für alle Nutzer sichtbar.
  • Teilen: Klicke bei öffentlichen Datensätzen auf die Schaltfläche zum Teilen, um einen Link zu kopieren, einen Einbettungscode abzurufen oder den Datensatz auf sozialen Plattformen zu teilen.

Datensatz löschen#

Lösche einen Datensatz, den du nicht mehr benötigst:

  1. Öffne Weitere Aktionen (die Schaltfläche …) im Kopfbereich des Datensatzes
  2. Wähle Datensatz löschen
  3. Bestätige im Dialog: „Dadurch wird [name] in den Papierkorb verschoben. Du kannst den Datensatz innerhalb von 30 Tagen wiederherstellen.“

Dasselbe Menü enthält Informationen, womit der unter Benutzerdefinierte Metadaten beschriebene Metadatendialog geöffnet wird, und Aktualisieren, womit der Datensatz erneut vom Server eingelesen wird.

Papierkorb und Wiederherstellung

Gelöschte Datensätze werden in den Papierkorb verschoben – sie werden nicht dauerhaft gelöscht. Du kannst sie innerhalb von 30 Tagen unter Settings > Trash wiederherstellen.

Mit dem Datensatz trainieren#

Starte das Training direkt über deinen Datensatz:

  1. Klicke auf der Datensatzseite auf New Model
  2. Wähle ein Projekt aus oder erstelle ein neues
  3. Lege die Trainingsparameter fest
  4. Starte das Training

Weitere Informationen findest du unter Cloud-Training.

Häufig gestellte Fragen#

  • Deine Daten werden in der ausgewählten Region (US, EU oder AP) verarbeitet und gespeichert. Bilder werden:

    1. auf Format und Größe geprüft
    2. abgelehnt, wenn die Mindestabmessung unter 28px liegt
    3. verkleinert, wenn sie größer als 4096px sind (das Seitenverhältnis bleibt erhalten; die Bilder werden für eine optimierte Speicherung kodiert; TIFF-Dateien werden wie hochgeladen gespeichert)
    4. mit Deduplizierung gespeichert, sodass identische Bilder nur einmal gespeichert werden
    5. als 256px-WebP-Miniaturansichten für schnelles Durchsuchen erzeugt
  • Die Ultralytics Platform verwaltet den Speicherplatz effizient:

    • Deduplizierung: Identische Bilder in derselben Datenregion werden nur einmal gespeichert
    • Integrität: Uploads werden auf Datenintegrität geprüft
    • Effizienz: Klone verwenden bereits gespeicherte Bilder erneut, statt sie zu kopieren; sie werden aber weiterhin auf das Speicherkontingent des Zielarbeitsbereichs angerechnet
    • Regional: Die Daten verbleiben in der ausgewählten Region (US, EU oder AP)
  • Ja. Ziehe Dateien in die Datensatzgalerie oder klicke auf das Upload-Symbol in der Kopfzeile der Seite. Dadurch wird direkt die systemeigene Dateiauswahl deines Browsers geöffnet. Neue Statistiken werden nach der Verarbeitung automatisch berechnet.

  • Ja. Kopiere oder schneide Bilder in einem Datensatz aus und füge sie in einen anderen Datensatz ein, den du bearbeiten kannst. Beschriftungen und Aufteilungen bleiben erhalten, und Ausschneiden entfernt die Bilder aus dem Quelldatensatz. Klassen werden anhand ihres Namens zugeordnet. Im Dialogfeld Klassen zuordnen kannst du Klassen zuordnen, die im Zieldatensatz noch nicht vorhanden sind. Siehe Bilder kopieren und verschieben.

  • Verwende die Funktion zum Verschieben mehrerer Bilder in eine Datenaufteilung:

    1. Wähle Bilder in der Tabellenansicht aus.
    2. Klicke mit der rechten Maustaste und wähle Move to split aus
    3. Wähle die Zieldatenaufteilung aus (Training, Validierung oder Test)
  • Ultralytics Platform unterstützt YOLO-Beschriftungen, COCO-JSON, LabelMe-JSON, Ultralytics- und Labelbox-NDJSON, semantische PNG-Masken und Tiefenkarten sowie das Hochladen unveränderter Bilder. Pascal-VOC-XML-Beschriftungen werden erkannt, aber nicht importiert:

    Eine .txt-Datei pro Bild mit normalisierten Koordinaten (Wertebereich 0–1):

    AufgabeFormatBeispiel
    Detectclass cx cy w h0 0.5 0.5 0.2 0.3
    Segmentclass x1 y1 x2 y2 ...0 0.1 0.1 0.9 0.1 0.9 0.9
    Semantischclass x1 y1 x2 y2 ...0 0.1 0.1 0.9 0.1 0.9 0.9
    Poseclass cx cy w h kx1 ky1 v1 ...0 0.5 0.5 0.2 0.3 0.6 0.7 2
    OBBclass x1 y1 x2 y2 x3 y3 x4 y40 0.1 0.1 0.9 0.1 0.9 0.9 0.1 0.9
    KlassifizierenVerzeichnisstrukturtrain/cats/, train/dogs/

    Sichtbarkeitskennzeichnungen für Posen: 0 = nicht beschriftet, 1 = beschriftet, aber verdeckt, 2 = beschriftet und sichtbar. Semantische Datensätze akzeptieren auch PNG-Masken anstelle von Polygondateien (siehe Semantische Masken).

  • Ja. Für jedes Bild werden gemeinsam Annotationen für alle 6 Annotationstypen (Erkennung, Segmentierung, semantische Segmentierung, Klassifizierung, Pose, OBB) gespeichert. Du kannst den aktiven Aufgabentyp des Datensatzes jederzeit ändern, ohne vorhandene Annotationen zu verlieren. Im Editor werden nur Annotationen des aktiven Aufgabentyps angezeigt und in Exporte und Trainingsläufe aufgenommen. Annotationen für andere Aufgaben bleiben erhalten und werden wieder angezeigt, wenn du zum vorherigen Aufgabentyp zurückwechselst.

  • Ja:

    BeschränkungWert
    Klassen pro Datensatz25,000
    Annotationen pro Bild10,000
    Koordinaten pro Annotation10,000
    Datensatzname100 Zeichen
    Datensatzbeschreibung1.000 Zeichen
    Benutzerdefinierte Metadaten500.000 serialisierte Zeichen
    Metadaten-Schlüssel der obersten Ebene128 Zeichen
  • Bei Datensätzen, die Daten aus Cloud-Speicher- oder On-Premise-Quellen lesen, bleiben die Bilddaten außerhalb von Platform. Daher sind Funktionen nicht verfügbar, die voraussetzen, dass Platform Kopien der Bilddaten besitzt:

    MerkmalMit der Cloud verbundenOn-Premise
    Intelligente und StapelannotationNicht verfügbarNicht verfügbar
    ClusteranalyseNicht verfügbarNicht verfügbar
    KlonenNicht verfügbarNicht verfügbar
    VersionsmomentaufnahmenNicht verfügbarNicht verfügbar
    NDJSON-ExportVerfügbarNicht verfügbar
    Import semantischer PNG-MaskenNicht verfügbarVerfügbar
    Gesichter unkenntlich machenNicht verfügbarNicht verfügbar
    Ähnliche Bilder findenNicht verfügbarNicht verfügbar
    Ähnliche Bilder generierenNicht verfügbarNicht verfügbar
    Bilder in den Datensatz einfügenNicht verfügbarNicht verfügbar

    Durchsuchen, manuelles Annotieren, Klassenverwaltung, Datenaufteilungen, Statistiken und Training funktionieren wie gewohnt.

Kommentare