Préparation des données#
La préparation des données est la base de modèles de computer vision réussis. Ultralytics Platform fournit des outils complets pour gérer tes données d'entraînement, du téléchargement à l'analyse en passant par l'annotation.
Watch: Get Started with Ultralytics Platform - Data
Présentation#
La section Données d'Ultralytics Platform t'aide à :
- Télécharge des images, des vidéos et des fichiers de jeux de données (ZIP, TAR incluant
.tar.gz/.tgz, NDJSON) - Connecte Google Cloud Storage, Amazon S3 ou Azure Blob Storage et utilise tes données sur place sans télécharger de copie
- Garde les pixels sur site avec des workers CPU/GPU Enterprise On Premise
- Annote avec des outils de dessin manuel et un étiquetage intelligent alimenté par SAM — choisis entre SAM 2.1 ou le nouveau SAM 3
- Analyser tes données avec des statistiques et des visualisations
- Exporte au format NDJSON pour un entraînement local

Flux de travail#
graph LR
A[Upload]:::start --> B[Annotate]:::proc
B --> C[Analyze]:::proc
C --> D[Train]:::out
classDef start fill:#4CAF50,color:#fff
classDef proc fill:#2196F3,color:#fff
classDef out fill:#9C27B0,color:#fff| Étape | Description |
|---|---|
| Upload | Importe des images, des vidéos ou des archives avec un traitement automatique |
| Annoter | Étiquette tes données avec des outils manuels pour les 6 types de tâches, ou utilise l'annotation SAM pour la détection, la segmentation, la segmentation sémantique et l'OBB |
| Analyser | Visualise les distributions de classes, les cartes thermiques spatiales et les statistiques de dimensions |
| Exporter | Télécharge au format NDJSON pour une utilisation hors ligne |
Tâches prises en charge#
Les jeux de données Ultralytics Platform prennent en charge 6 des 7 types de tâches YOLO — les jeux de données de depth arrivent bientôt (les modèles de profondeur et la prédiction sont déjà pris en charge) :
| Tâche | Description | Outil d'annotation |
|---|---|---|
| Detect | Détection d'objets avec des boîtes englobantes (BBox) | Outil rectangle |
| Segment | Segmentation d'instance avec des masques de pixels | Outil polygone |
| Semantic | Segmentation sémantique avec des régions de pixels par classe | Outil polygone |
| Classify | Classification au niveau de l'image | Sélecteur de classe |
| Pose | Estimation de points clés avec des modèles de squelette intégrés et personnalisés | Outil points clés |
| OBB | Boîtes englobantes orientées pour les objets en rotation | Outil boîte orientée |
Le type de tâche est défini lors de la création d'un jeu de données et détermine les outils d'annotation disponibles. Tu peux le modifier plus tard via le sélecteur de tâches dans l'en-tête du jeu de données, mais les annotations incompatibles ne seront plus affichées après le changement.
Fonctionnalités clés#
Stockage intelligent#
Ultralytics Platform utilise le stockage adressable par contenu (CAS) pour une gestion efficace des données :
- Dédoublonnage: Les octets d'image identiques dans la même région de données réutilisent un seul objet CAS via le hachage XXH3-128
- Intégrité : l'adressage basé sur le hachage garantit l'intégrité des données
- Efficacité : stockage optimisé et traitement rapide
URI de jeux de données#
Fais référence aux jeux de données en utilisant le format d'URI ul:// (vois Using Platform Datasets) :
yolo train data=ul://username/datasets/my-datasetCela permet de s'entraîner sur les jeux de données de la plateforme depuis n'importe quelle machine avec ta API key configurée.
from ultralytics import YOLO
model = YOLO("yolo26n.pt")
model.train(data="ul://username/datasets/my-dataset", epochs=100)Versionnage des jeux de données#
Crée des instantanés NDJSON immuables de ton jeu de données pour un entraînement reproductible. Chaque version capture le nombre d'images, de classes et d'annotations au moment de la création. Vois Versions Tab pour plus de détails.
Onglets de jeu de données#
Les pages des jeux de données peuvent afficher jusqu'à six onglets, en fonction de l'état du jeu de données et de tes autorisations :
| Onglet | Description |
|---|---|
| Images | Parcours les images dans une vue en grille, compacte ou en tableau avec des superpositions d'annotations |
| Classes | Visualise et modifie les noms de classes, les couleurs et le nombre d'étiquettes par classe |
| Graphiques | Statistiques automatiques : distribution des divisions, nombre de classes, cartes thermiques |
| Modèles | Models entraînés sur ce jeu de données avec métriques et statut |
| Versions | Crée et télécharge des instantanés NDJSON immuables pour un entraînement reproductible |
| Errors | Images ayant échoué au traitement avec des détails sur les erreurs et des conseils de correction |
Classes et Charts apparaissent lorsque le jeu de données contient des images. Errors apparaît uniquement en cas d'échecs de traitement. Versions apparaît lorsque tu as l'accès en modification, ou en mode lecture seule lorsque des versions existent déjà.
Clustering#
Explore ton jeu de données sous forme de nuage de points 2D interactif où les images visuellement similaires sont proches les unes des autres — utile pour faire surface aux clusters, doublons et valeurs aberrantes, et pour inspecter comment les splits ou les classes sont distribués dans tes données. Entoure une région du graphique au lasso pour filtrer la galerie sur ces images. Vois Clustering pour plus de détails.
Statistiques et visualisation#
L'onglet Charts fournit une analyse automatique incluant :
- Distribution des divisions : graphique en anneau du nombre d'images d'entraînement/validation/test
- Classes principales : graphique en anneau des classes d'annotation les plus fréquentes
- Dimensions des images : histogramme de la distribution de la largeur et de la hauteur des images (en pixels)
- Points par instance : distribution du nombre de sommets de polygone ou de points clés (jeux de données de segmentation/pose)
- Emplacements des annotations : carte thermique 2D des positions centrales des boîtes englobantes
- Dimensions des images 2D : carte thermique 2D de la largeur par rapport à la hauteur avec des lignes de guidage de ratio d'aspect
Liens rapides#
- Datasets : Télécharge, gère et exporte tes données d'entraînement
- Annotation : Étiquette les données avec des outils manuels et assistés par IA
- Cloud Training : Entraîne des modèles sur tes jeux de données annotés
- Dataset URI : Utilise des URI
ul://pour t'entraîner de n'importe où
FAQ#
Ultralytics Platform prend en charge :
Images : JPEG, PNG, WebP, BMP, TIFF, HEIC, AVIF, JP2, DNG, MPO (max 50 Mo chacune)
Vidéos : MP4, WebM, MOV, MKV, M4V (max 1 Go, frames extraites à 1 FPS, max 100 frames)
Fichiers de jeux de données : Archives ZIP ou TAR incluant
.tar.gzet.tgz(max 10 Go sur Free, 20 Go sur Pro, 50 Go sur Enterprise) contenant des images avec des YOLO-format labels optionnels, ainsi que des exportations NDJSONLes limites de stockage dépendent de ton forfait :
Forfait Limite de stockage Gratuit 100 GB Pro 500 GB Enterprise Illimité Limites de fichiers individuels : Images 50 Mo, Vidéos 1 Go, jeux de données 10 Go sur Free / 20 Go sur Pro / 50 Go sur Enterprise
Oui ! Utilise le format d'URI de jeu de données pour t'entraîner localement :
export ULTRALYTICS_API_KEY="YOUR_API_KEY" yolo train model=yolo26n.pt data=ul://username/datasets/my-dataset epochs=100Ou exporte ton jeu de données au format NDJSON pour transférer ses métadonnées, splits, annotations et URL d'images signées.