YOLO Vision 2026 :

Intégration Azure Blob Storage#

L'intégration Azure Blob Storage connecte les conteneurs de ton compte de stockage à Ultralytics Platform. Tes images restent dans tes conteneurs — Platform les indexe sur place, ce qui te permet de parcourir, d'annoter et d'entraîner des modèles YOLO sans en télécharger de copie.

Fonctionnalité Pro

Les jeux de données Azure Blob Storage nécessitent un abonnement Pro ou Enterprise. Les espaces de travail gratuits voient l'intégration et sont invités à passer à la version supérieure lors de la connexion. Les jeux de données Azure Blob Storage existants restent entièrement accessibles si un abonnement se termine — seules les nouvelles connexions et les nouveaux imports nécessitent l'offre Pro.

Obtenir une chaîne de connexion#

Platform lit uniquement à partir de ton stockage — elle n'écrit, ne modifie ni ne supprime jamais tes blobs. L'intégration actuelle nécessite une chaîne de connexion avec clé d'accès au compte, ce qui accorde des privilèges à l'échelle du compte, même si Platform utilise uniquement des opérations de liste et de lecture :

  1. Dans le portail Azure, ouvre ton compte de stockage.
  2. Va dans Sécurité + réseau > Clés d'accès.
  3. Copie une chaîne de connexion.

La chaîne doit comporter AccountName, AccountKey et HTTPS comme protocole — le format que Azure te donne sous Access keys. Les chaînes de connexion avec jeton SAS, qui contiennent SharedAccessSignature au lieu de AccountKey, sont rejetées.

Cloud public Azure uniquement

Les connexions utilisent le point de terminaison standard blob.core.windows.net. Les clouds souverains (Azure China, Azure Government) et les points de terminaison blob personnalisés ne sont pas pris en charge.

Se connecter à la Platform#

  1. Va dans Settings > Integrations et sélectionne Azure Blob Storage dans la liste des intégrations.
  2. Colle la chaîne de connexion.
  3. Clique sur Find available containers, puis sélectionne les conteneurs à connecter. Tu peux aussi saisir un nom de conteneur manuellement.
  4. Clique sur Connecter. Platform vérifie qu'elle peut lister et lire chaque conteneur sélectionné avant d'enregistrer quoi que ce soit.

Ultralytics Platform Azure Blob Storage Integration Settings

Tu as besoin du rôle d'administrateur ou de propriétaire d'espace de travail pour connecter un stockage cloud. Une connexion prend en charge jusqu'à 50 conteneurs, et la découverte liste jusqu'à 300 conteneurs dans le compte de stockage.

La reconnexion du même compte de stockage plus tard ajoute de nouveaux conteneurs à l'intégration existante. Un identifiant enregistré n'est remplacé que si son remplaçant peut toujours lire chaque conteneur que tu as déjà connecté.

Sécurité des identifiants

Une clé de compte peut autoriser des opérations d'écriture et de suppression ou créer des jetons SAS si elle est exposée en dehors de Platform. Les identifiants sont chiffrés au repos avec AES-256-GCM, ne sont jamais renvoyés au navigateur et ne sont jamais exposés aux charges de travail d'entraînement. Utilise un compte de stockage dédié lorsque cela est possible. Pour révoquer l'accès, fais pivoter les clés d'accès du compte de stockage dans Azure.

Créer un jeu de données à partir d'un conteneur Blob#

  1. Clique sur New Dataset et ouvre l'onglet Cloud.
  2. Choisis un conteneur connecté et navigue jusqu'au dossier contenant tes données.
  3. Confirme le dossier, ajuste le nom du jeu de données et crée-le.

Platform liste le dossier une fois et indexe ce qu'elle trouve :

  • Images — Les blobs .jpg, .jpeg, .png, .webp et .avif sont indexés avec des dimensions lues via des requêtes limitées. Platform ne conserve pas de deuxième copie de l'image source.
  • Labels — les fichiers d'accompagnement YOLO .txt sont analysés pour former des annotations sur la Platform, associés selon la structure standard images/labels/ ou en tant qu'éléments frères dans le même dossier.
  • Metadata — un fichier YAML fournit les noms des classes et la forme des points clés de pose, exactement comme pour un téléversement d'archive. data.yaml et data.yml sont recommandés lorsque le dossier en contient plusieurs.
  • Task — un échantillon des fichiers d'étiquettes détermine la tâche, de sorte que les dossiers de segmentation, de pose et d'OBB sont reconnus par la forme de leurs étiquettes plutôt que par la tâche choisie dans la boîte de dialogue.
  • Splits — Les noms de dossiers train, val et test dans le chemin du blob attribuent automatiquement les divisions.

Le dataset se comporte ensuite comme n'importe quel autre : parcours-le et annote-le, rends-le public ou privé, partage-le avec ton équipe et entraîne-le via l'entraînement géré. Les originaux sont diffusés à la demande, et les images indexées ne consomment pas ton quota de stockage sur la Platform.

Limites

Une importation unique indexe jusqu'à 50 000 blobs, et les fichiers d'étiquettes ou YAML jusqu'à 1 Mo chacun. Les conteneurs plus volumineux doivent être divisés en plusieurs jeux de données.

Garde les blobs indexés immuables

Chaque image indexée est épinglée à son ETag de blob, et Platform échoue de manière sécurisée si un blob change sous-jacente. Ajoute de nouveaux blobs au lieu d'écraser ceux existants.

Importations échouées#

Si une importation échoue — dossier vide, faute de frappe dans le chemin ou autorisations révoquées — le jeu de données affiche l'erreur sur sa page. Les éditeurs peuvent cliquer sur Réessayer l'importation pour la redémarrer avec le conteneur et le dossier stockés, ou créer un nouveau jeu de données pointant vers le chemin corrigé.

Une nouvelle tentative répertorie à nouveau le dossier au lieu de reprendre : les blobs ajoutés depuis la première tentative sont inclus, et les blobs qui n'y sont plus sont retirés du dataset.

Entraînement#

L'entraînement géré fonctionne via le flux d'entraînement normal. L'entraînement utilise les copies propres de Platform des images épinglées pendant toute la durée de l'exécution, et tes identifiants Azure ne sont jamais exposés aux charges de travail d'entraînement.

Déconnecter une connexion#

La déconnexion supprime la chaîne de connexion enregistrée sans toucher à rien dans Azure. Les datasets créés à partir de ces conteneurs restent dans ton espace de travail avec leurs classes, étiquettes et annotations, mais leurs images ne peuvent pas être chargées, prévisualisées ou utilisées pour l'entraînement tant que le même compte de stockage n'est pas reconnecté.

Utilise l'REST API avec l'ID d'intégration renvoyé par GET /api/integrations/buckets :

curl -X DELETE \
  -H "Authorization: Bearer YOUR_API_KEY" \
  https://platform.ultralytics.com/api/integrations/buckets/INTEGRATION_ID
from ultralytics_platform import Platform

client = Platform()  # reads ULTRALYTICS_API_KEY
integrations = client.storage_integrations.list()
client.storage_integrations.delete("INTEGRATION_ID")

Pour révoquer l'accès à la source à la place, fais pivoter les clés d'accès du compte de stockage dans Azure.

Limitations actuelles#

Les jeux de données basés sur Azure excluent actuellement les fonctionnalités qui nécessitent des copies de tes images appartenant à Platform : l'annotation automatique, l'analyse par clustering, le clonage de jeux de données et les instantanés de version immuables.

Supprimer un jeu de données basé sur Azure, ou des images individuelles de celui-ci, supprime uniquement les références de Platform — tes blobs ne sont jamais touchés.

Consulte également les intégrations Google Cloud Storage et Amazon S3.

Contributeurs

Commentaires