Intégration Azure Blob Storage#
L’intégration Azure Blob Storage connecte les conteneurs de ton compte de stockage à Ultralytics Platform. Tes images restent dans tes conteneurs — Platform les indexe sur place, afin que tu puisses les parcourir, les annoter et entraîner des modèles YOLO sans en téléverser une copie.
Les jeux de données Azure Blob Storage nécessitent un plan Pro ou Enterprise. Les espaces de travail gratuits voient l’intégration et sont invités à passer à une formule supérieure lors de la connexion. Les jeux de données Azure Blob Storage existants restent entièrement accessibles si un abonnement prend fin — seules les nouvelles connexions et importations nécessitent Pro.
Obtenir une chaîne de connexion#
Platform ne fait que lire depuis ton stockage — il n’écrit, ne modifie et ne supprime jamais tes blobs. L’intégration actuelle nécessite une chaîne de connexion utilisant une clé d’accès au compte, qui accorde des privilèges à l’échelle du compte, même si Platform utilise uniquement des opérations de listage et de lecture :
- Dans le portail Azure, ouvre ton compte de stockage.
- Accède à Sécurité + réseau > Clés d’accès.
- Copie une chaîne de connexion.
La chaîne doit contenir AccountName, AccountKey et HTTPS comme protocole — il s’agit du format fourni par Azure sous Clés
d’accès. Les chaînes de connexion utilisant un jeton SAS, qui contiennent SharedAccessSignature au lieu de AccountKey, sont rejetées.
Les connexions utilisent le point de terminaison standard blob.core.windows.net. Les clouds souverains (Azure Chine, Azure Government) et les points de terminaison blob personnalisés ne sont pas pris en charge.
Se connecter à Platform#
- Accède à Paramètres > Intégrations et sélectionne Azure Blob Storage dans la liste des intégrations.
- Colle la chaîne de connexion.
- Clique sur Rechercher les conteneurs disponibles, puis sélectionne les conteneurs à connecter. Tu peux également saisir manuellement le nom d’un conteneur.
- Clique sur Connecter. Platform vérifie qu’il peut répertorier et lire chaque conteneur sélectionné avant d’enregistrer quoi que ce soit.

Tu dois disposer du rôle d’administrateur ou de propriétaire de l’espace de travail pour connecter un stockage cloud. Une connexion peut contenir jusqu’à 50 conteneurs, et la découverte répertorie jusqu’à 300 conteneurs dans le compte de stockage.
Si tu reconnectes ultérieurement le même compte de stockage, les nouveaux conteneurs sont ajoutés à l’intégration existante. Un identifiant enregistré n’est remplacé que lorsque son remplaçant peut toujours lire chaque conteneur que tu as déjà connecté.
Une clé de compte peut autoriser les opérations d’écriture et de suppression ou créer des jetons SAS si elle est exposée en dehors de Platform. Les identifiants sont chiffrés au repos avec AES-256-GCM, ne sont jamais renvoyés au navigateur et ne sont jamais exposés aux charges de travail d’entraînement. Utilise si possible un compte de stockage dédié. Pour révoquer l’accès, fais tourner les clés d’accès du compte de stockage dans Azure.
Créer un jeu de données à partir d’un conteneur blob#
- Clique sur New Dataset et ouvre l’onglet Cloud.
- Sélectionne un conteneur connecté et accède au dossier contenant tes données.
- Confirme le dossier, ajuste le nom du jeu de données, puis crée-le.
Platform répertorie le dossier une seule fois et indexe ce qu’il trouve :
- Images — Les blobs
.jpg,.jpeg,.png,.webpet.avifsont indexés avec les dimensions lues au moyen de requêtes limitées. Platform ne conserve pas une seconde copie de l’image source. - Étiquettes — Les fichiers associés YOLO
.txtsont analysés pour créer des annotations dans Platform, puis associés selon la structure standardimages/→labels/ou en tant que fichiers voisins dans le même dossier. - Métadonnées — Un fichier YAML fournit les noms des classes et la structure des points clés de pose, exactement comme lors d’un téléversement d’archive.
data.yamletdata.ymlsont privilégiés lorsque le dossier en contient plusieurs. - Tâche — Un échantillon des fichiers d’étiquettes détermine la tâche ; les dossiers de segmentation, de pose et d’OBB sont donc reconnus à partir de la structure de leurs étiquettes plutôt que de la tâche choisie dans la boîte de dialogue.
- Partitions — Les noms de dossiers
train,valettestdans le chemin du blob attribuent automatiquement les partitions.
Le jeu de données se comporte ensuite comme n’importe quel autre : parcours-le et annote-le, rends-le public ou privé, partage-le avec ton équipe et entraîne des modèles dessus via l’entraînement géré. Les originaux sont diffusés à la demande et les images indexées ne consomment pas ton quota de stockage Platform.
Une seule importation peut indexer jusqu’à 50 000 blobs, ainsi que des fichiers d’étiquettes ou YAML de 1 Mo chacun au maximum. Les conteneurs plus volumineux doivent être répartis sur plusieurs jeux de données.
Chaque image indexée est associée à l’ETag de son blob, et Platform échoue de manière sécurisée si un blob est modifié en dessous. Ajoute de nouveaux blobs au lieu d’écraser ceux qui existent.
Importations échouées#
Si une importation échoue — dossier vide, erreur de chemin ou autorisations révoquées — le jeu de données affiche l’erreur sur sa page. Les éditeurs peuvent cliquer sur Réessayer l’importation pour la redémarrer avec le conteneur et le dossier enregistrés, ou créer un nouveau jeu de données pointant vers le chemin corrigé.
Une nouvelle tentative répertorie à nouveau le dossier au lieu de reprendre l’opération : les blobs ajoutés depuis la première tentative sont récupérés, et ceux qui ne s’y trouvent plus sont retirés du jeu de données.
Entraînement#
L’entraînement géré s’effectue selon le flux d’entraînement normal. Pendant toute la durée de l’exécution, l’entraînement utilise les propres copies des images associées de Platform, et tes identifiants Azure ne sont jamais exposés aux charges de travail d’entraînement.
Déconnecter une connexion#
La déconnexion supprime la chaîne de connexion enregistrée sans rien modifier dans Azure. Les jeux de données créés à partir de ces conteneurs restent dans ton espace de travail avec leurs classes, étiquettes et annotations, mais leurs images ne peuvent pas être chargées, prévisualisées ou utilisées pour l’entraînement tant que le même compte de stockage n’est pas reconnecté.
Utilise la REST API avec l’identifiant d’intégration renvoyé par GET /api/integrations/buckets :
curl -X DELETE \
-H "Authorization: Bearer YOUR_API_KEY" \
https://platform.ultralytics.com/api/integrations/buckets/INTEGRATION_IDfrom ultralytics_platform import Platform
client = Platform() # reads ULTRALYTICS_API_KEY
integrations = client.storage_integrations.list()
client.storage_integrations.delete("INTEGRATION_ID")Pour révoquer plutôt l’accès à la source, fais tourner les clés d’accès du compte de stockage dans Azure.
Limites actuelles#
Les jeux de données associés à Azure excluent actuellement les fonctionnalités qui nécessitent des copies de tes images appartenant à Platform : annotation automatique, analyse de clustering, clonage de jeux de données et instantanés de versions immuables.
La suppression d’un jeu de données associé à Azure, ou d’images individuelles qu’il contient, supprime uniquement les références de Platform — tes blobs ne sont jamais modifiés.
Consulte également les intégrations Google Cloud Storage et Amazon S3.
FAQ#
Non. Platform liste le conteneur une seule fois et indexe les dimensions des images et les étiquettes qu'il trouve. Les originaux sont diffusés en continu à la demande pour la navigation et l'annotation, et l'entraînement géré fonctionne à partir des copies propres à Platform des images épinglées uniquement pour la durée de l'exécution. Les images indexées ne sont pas décomptées de ton storage quota.
Un jeu de données est indexé une seule fois lors de sa création. Les nouveaux objets ne sont pas pris en compte tant que tu ne crées pas un nouveau jeu de données ou que tu ne relances pas un import échoué, et chaque image indexée est épinglée à sa version, de sorte que l'écrasement d'un objet entraîne l'échec de Platform sur cette image. Ajoute de nouveaux objets au lieu de remplacer ceux qui existent déjà.
Les fonctionnalités qui nécessitent des copies de tes images appartenant à Platform sont exclues sur les jeux de données connectés : l'annotation automatique, l'analyse par clustering, le clonage de jeux de données et les instantanés de version immuables. L'annotation manuelle, le partage et l'entraînement fonctionnent normalement.
Déconnecte l'intégration dans Settings > Integrations pour supprimer les identifiants stockés, ou fais pivoter les clés d'accès du compte de stockage dans Azure. Aucune de ces actions ne touche aux données de tes conteneurs.