Ultralytics YOLO27 :

Intégration Azure Blob Storage#

L’intégration Azure Blob Storage connecte les conteneurs de ton compte de stockage à Ultralytics Platform. Tes images restent dans tes conteneurs : Platform les indexe sur place, pour que tu puisses les parcourir, les annoter et entraîner des modèles YOLO sans en téléverser de copie.

Fonctionnalité Pro

Les jeux de données Azure Blob Storage nécessitent un forfait Pro ou Enterprise. Les espaces de travail gratuits voient l’intégration et sont invités à passer à un forfait supérieur au moment de la connexion. Les jeux de données Azure Blob Storage existants restent entièrement accessibles si un abonnement prend fin : seules les nouvelles connexions et importations nécessitent Pro.

Obtenir une chaîne de connexion#

Platform ne fait que lire les données de ton stockage : il n’écrit, ne modifie et ne supprime jamais tes blobs. L’intégration actuelle nécessite une chaîne de connexion avec clé d’accès au compte, qui accorde des privilèges à l’échelle du compte, même si Platform utilise uniquement des opérations de liste et de lecture :

  1. Dans le portail Azure, ouvre ton compte de stockage.
  2. Va dans Sécurité + réseau > Clés d’accès.
  3. Copie une chaîne de connexion.

La chaîne doit contenir AccountName, AccountKey et HTTPS comme protocole — le format fourni par Azure sous Clés d’accès. Les chaînes de connexion avec jeton SAS, qui contiennent SharedAccessSignature au lieu de AccountKey, sont refusées.

Cloud public Azure uniquement

Les connexions utilisent le point de terminaison standard blob.core.windows.net. Les clouds souverains (Azure China, Azure Government) et les points de terminaison blob personnalisés ne sont pas pris en charge.

Se connecter à Platform#

  1. Va dans Paramètres > Intégrations et sélectionne Azure Blob Storage dans la liste des intégrations.
  2. Colle la chaîne de connexion.
  3. Clique sur Rechercher les conteneurs disponibles, puis sélectionne les conteneurs à connecter. Tu peux aussi saisir manuellement le nom d’un conteneur.
  4. Clique sur Connecter. Avant d’enregistrer quoi que ce soit, Platform vérifie qu’il peut lister et lire chaque conteneur sélectionné.

Paramètres de l’intégration Azure Blob Storage d’Ultralytics Platform

Tu dois avoir le rôle d’administrateur ou de propriétaire de l’espace de travail pour connecter un stockage cloud. Une connexion peut inclure jusqu’à 50 conteneurs, et la découverte répertorie jusqu’à 300 conteneurs dans le compte de stockage.

Si tu reconnectes le même compte de stockage plus tard, les nouveaux conteneurs sont ajoutés à l’intégration existante. Un identifiant enregistré n’est remplacé que si son remplaçant peut toujours lire tous les conteneurs déjà connectés.

Sécurité des identifiants

Une clé de compte peut autoriser des opérations d’écriture et de suppression ou la création de jetons SAS si elle est exposée en dehors de Platform. Les identifiants sont chiffrés au repos avec AES-256-GCM, ne sont jamais renvoyés au navigateur et ne sont jamais exposés aux charges de travail d’entraînement. Dans la mesure du possible, utilise un compte de stockage dédié. Pour révoquer l’accès, renouvelle les clés d’accès du compte de stockage dans Azure.

Créer un jeu de données à partir d’un conteneur Blob#

  1. Clique sur Nouveau jeu de données, puis ouvre l’onglet Cloud.
  2. Choisis un conteneur connecté et accède au dossier qui contient tes données.
  3. Confirme le dossier, modifie le nom du jeu de données si nécessaire, puis crée le jeu de données.

Platform liste le contenu du dossier une seule fois et indexe les éléments trouvés :

  • Images — les blobs .jpg, .jpeg, .png, .webp et .avif sont indexés ; leurs dimensions sont lues au moyen de requêtes limitées. Platform ne conserve pas de seconde copie de l’image source.
  • Étiquettes — Les fichiers annexes YOLO .txt sont analysés pour créer des annotations dans Platform, selon l’organisation standard images/ → labels/ ou en tant que fichiers voisins dans le même dossier.
  • Métadonnées — Un fichier YAML fournit les noms des classes et la forme des points clés de pose, comme pour un téléversement d’archive. Les fichiers data.yaml et data.yml sont prioritaires si le dossier en contient plusieurs.
  • Tâche — Un échantillon des fichiers d’étiquettes détermine la tâche : les dossiers de segmentation, de pose et d’OBB sont donc reconnus d’après la forme de leurs étiquettes, et non selon la tâche choisie dans la boîte de dialogue.
  • Sous-ensembles — les noms de dossier train, val et test dans le chemin des blobs attribuent automatiquement les sous-ensembles.

Le jeu de données fonctionne ensuite comme n’importe quel autre : tu peux le parcourir, l’annoter, le rendre public ou privé, le partager avec ton équipe et l’utiliser pour l’entraînement géré. Les originaux sont transférés à la demande, et les images indexées ne consomment pas ton quota de stockage Platform.

Limites

Une seule importation indexe jusqu’à 500 000 blobs, et des fichiers d’étiquettes ou YAML d’une taille maximale de 1 Mo chacun. Les conteneurs plus volumineux doivent être répartis sur plusieurs jeux de données.

Garde les blobs indexés immuables

Chaque image indexée est associée à l’ETag de son blob, et Platform échoue de manière sécurisée si un blob est modifié. Ajoute de nouveaux blobs au lieu de remplacer les blobs existants.

Échecs d’importation#

Si une importation échoue — dossier vide, erreur dans le chemin ou autorisations révoquées — le jeu de données affiche l’erreur sur sa page. Les éditeurs peuvent cliquer sur Relancer l’importation pour la redémarrer avec le conteneur et le dossier enregistrés, ou créer un nouveau jeu de données pointant vers le chemin corrigé.

Une nouvelle tentative réénumère le dossier au lieu de reprendre l’importation : les blobs ajoutés depuis la première tentative sont récupérés, et les blobs qui n’y sont plus sont retirés du jeu de données.

Entraînement#

L’entraînement géré suit le processus d’entraînement habituel. Pendant toute la durée de l’exécution, l’entraînement utilise les propres copies des images épinglées de Platform, et tes identifiants Azure ne sont jamais exposés aux charges de travail d’entraînement.

Déconnecter une intégration#

La déconnexion supprime la chaîne de connexion enregistrée sans rien modifier dans Azure. Les jeux de données créés à partir de ces conteneurs restent dans ton espace de travail avec leurs classes, étiquettes et annotations, mais leurs images ne peuvent pas être chargées, prévisualisées ni utilisées pour l’entraînement tant que le même compte de stockage n’est pas reconnecté.

Utilise l’API REST avec l’ID d’intégration renvoyé par GET /api/integrations/buckets :

curl -X DELETE \
  -H "Authorization: Bearer YOUR_API_KEY" \
  https://platform.ultralytics.com/api/integrations/buckets/INTEGRATION_ID
from ultralytics_platform import Platform

client = Platform()  # reads ULTRALYTICS_API_KEY
integrations = client.storage_integrations.list()
client.storage_integrations.delete("INTEGRATION_ID")

Pour révoquer l’accès directement à la source, renouvelle plutôt les clés d’accès du compte de stockage dans Azure.

Limites actuelles#

Les jeux de données associés à Azure ne prennent actuellement pas en charge les fonctionnalités qui nécessitent des copies de tes images appartenant à Platform : l’annotation automatique, l’analyse par regroupement, le clonage de jeux de données et les instantanés de version immuables.

La suppression d’un jeu de données associé à Azure, ou d’images individuelles de celui-ci, ne supprime que les références de Platform : tes blobs ne sont jamais touchés.

Voir aussi les intégrations Google Cloud Storage et Amazon S3.

FAQ#

  • Non. Platform répertorie le conteneur une fois et indexe les dimensions des images ainsi que les étiquettes trouvées. Les originaux sont transmis à la demande pour la navigation et l’annotation, et l’entraînement géré utilise les propres copies des images épinglées de Platform uniquement pendant la durée de l’exécution. Les images indexées ne sont pas comptabilisées dans ton quota de stockage.

  • Un jeu de données est indexé une seule fois lors de sa création. Les nouveaux objets ne sont pas récupérés tant que tu n’as pas créé un nouveau jeu de données ou relancé une importation échouée, et chaque image indexée est associée à sa version : si tu remplaces un objet, Platform bloque l’accès à cette image. Ajoute de nouveaux objets au lieu de remplacer ceux qui existent déjà.

  • Les fonctionnalités qui nécessitent que Platform possède des copies de tes images ne sont pas disponibles sur les jeux de données connectés : l’annotation automatique, l’analyse de regroupement, le clonage de jeux de données et les instantanés de version immuables. L’annotation manuelle, le partage et l’entraînement fonctionnent normalement.

  • Déconnecte l’intégration dans Paramètres > Intégrations pour supprimer les identifiants enregistrés, ou renouvelle les clés d’accès du compte de stockage dans Azure. Aucune de ces actions ne touche aux données de tes conteneurs.

Commentaires