Intégration Google Cloud Storage#
L’intégration Google Cloud Storage connecte tes buckets GCS à Ultralytics Platform. Tes images restent dans tes buckets : Platform les indexe sur place pour que tu puisses parcourir, annoter et entraîner des modèles YOLO sans en téléverser de copie.
Les jeux de données Google Cloud Storage nécessitent un forfait Pro ou Enterprise. Les espaces de travail gratuits voient l’intégration et sont invités à passer à un forfait supérieur au moment de la connexion. Les jeux de données Google Cloud Storage existants restent entièrement accessibles si un abonnement prend fin : seules les nouvelles connexions et importations nécessitent Pro.
Créer un compte de service en lecture seule#
Platform ne fait que lire les données de ton stockage : elle n’écrit, ne modifie et ne supprime jamais tes objets. Crée un compte de service dédié avec un accès en lecture seule :
- Dans la console Google Cloud, accède à IAM et administration > Comptes de service et crée un compte de service.
- Attribue-lui le rôle Lecteur des objets Storage (
roles/storage.objectViewer) sur les buckets que tu veux connecter. - Ouvre le compte de service, sélectionne Clés > Ajouter une clé > Créer une clé, choisis JSON, puis télécharge le fichier de clé.
roles/storage.objectViewer couvre toutes les opérations de Platform sur tes données, mais n’autorise pas la liste des
buckets d’un projet. Ajoute un rôle comprenant storage.buckets.list si tu veux que Platform trouve tes buckets pour toi ;
sinon, saisis manuellement le nom de chaque bucket lors de la connexion.
Se connecter à Platform#
- Accède à Paramètres > Intégrations et sélectionne Google Cloud Storage dans la liste des intégrations.
- Colle le contenu de la clé JSON du compte de service.
- Clique sur Rechercher les buckets disponibles, puis sélectionne les buckets à connecter. Si le compte de service ne peut pas lister les buckets, saisis manuellement le nom d’un bucket connu.
- Clique sur Connecter. Avant d’enregistrer quoi que ce soit, Platform vérifie qu’elle peut lister et lire chaque bucket sélectionné.

Tu dois avoir le rôle d’administrateur ou de propriétaire de l’espace de travail pour connecter un stockage cloud. Une connexion peut inclure jusqu’à 50 buckets, et la découverte en répertorie jusqu’à 300 parmi ceux auxquels le compte de service a accès.
Ton navigateur lit le fichier de clé collé et n’envoie que les trois champs dont Platform a besoin : client_email, private_key,
et project_id. Le reste du JSON ne quitte jamais la page.
Si tu reconnectes le même compte de service ultérieurement, les nouveaux buckets sont ajoutés à l’intégration existante. Un identifiant enregistré n’est remplacé que si le nouvel identifiant peut toujours lire tous les buckets que tu as déjà connectés.
Les identifiants sont chiffrés au repos avec AES-256-GCM, ne sont jamais renvoyés au navigateur et ne sont jamais exposés aux charges de travail d’entraînement. Pour révoquer l’accès, supprime la clé du compte de service dans Google Cloud.
Créer un jeu de données à partir d’un bucket GCS#
- Clique sur Nouveau jeu de données, puis ouvre l’onglet Cloud.
- Choisis un bucket connecté, puis accède au dossier contenant tes données.
- Confirme le dossier, modifie le nom du jeu de données si nécessaire, puis crée le jeu de données.
Platform liste le contenu du dossier une seule fois et indexe les éléments trouvés :
- Images — Les objets
.jpg,.jpeg,.png,.webpet.avifsont indexés, et leurs dimensions sont lues au moyen de requêtes limitées. Platform ne conserve pas de seconde copie de l’image source. - Étiquettes — Les fichiers annexes YOLO
.txtsont analysés pour créer des annotations dans Platform, selon l’organisation standardimages/→labels/ou en tant que fichiers voisins dans le même dossier. - Métadonnées — Un fichier YAML fournit les noms des classes et la forme des points clés de pose, comme pour un téléversement d’archive. Les fichiers
data.yamletdata.ymlsont prioritaires si le dossier en contient plusieurs. - Tâche — Un échantillon des fichiers d’étiquettes détermine la tâche : les dossiers de segmentation, de pose et d’OBB sont donc reconnus d’après la forme de leurs étiquettes, et non selon la tâche choisie dans la boîte de dialogue.
- Ensembles — Les noms de dossier
train,valettestdans le chemin d’accès aux objets attribuent automatiquement les ensembles.
Le jeu de données fonctionne ensuite comme n’importe quel autre : tu peux le parcourir, l’annoter, le rendre public ou privé, le partager avec ton équipe et l’utiliser pour l’entraînement géré. Les originaux sont transférés à la demande, et les images indexées ne consomment pas ton quota de stockage Platform.
Une seule importation peut indexer jusqu’à 500 000 objets, ainsi que des fichiers d’étiquettes ou YAML d’une taille maximale de 1 Mo chacun. Les buckets plus volumineux doivent être répartis entre plusieurs jeux de données.
Chaque image indexée est associée à la génération de son objet GCS, et Platform bloque l’accès si un objet est modifié. Ajoute de nouveaux objets plutôt que de remplacer ceux qui existent déjà.
Échecs d’importation#
Si une importation échoue — dossier vide, erreur dans le chemin ou autorisations révoquées — le jeu de données affiche l’erreur sur sa page. Les éditeurs peuvent cliquer sur Réessayer l’importation pour la relancer avec le bucket et le dossier enregistrés, ou créer un nouveau jeu de données pointant vers le chemin corrigé.
Une nouvelle tentative reliste le dossier au lieu de reprendre l’importation : les objets ajoutés depuis la première tentative sont récupérés, et ceux qui ne s’y trouvent plus sont retirés du jeu de données.
Entraînement#
L’entraînement géré suit le processus d’entraînement habituel. Pendant toute la durée de l’exécution, l’entraînement utilise les propres copies des images épinglées de Platform, et tes identifiants Google Cloud ne sont jamais exposés aux charges de travail d’entraînement.
Déconnecter une intégration#
La déconnexion supprime les identifiants enregistrés sans rien modifier dans Google Cloud. Les jeux de données créés à partir de ces buckets restent dans ton espace de travail avec leurs classes, étiquettes et annotations, mais leurs images ne peuvent plus être chargées, prévisualisées ni utilisées pour l’entraînement tant que le même compte de service n’est pas reconnecté.
Utilise l’API REST avec l’ID d’intégration renvoyé par GET /api/integrations/buckets :
curl -X DELETE \
-H "Authorization: Bearer YOUR_API_KEY" \
https://platform.ultralytics.com/api/integrations/buckets/INTEGRATION_IDfrom ultralytics_platform import Platform
client = Platform() # reads ULTRALYTICS_API_KEY
integrations = client.storage_integrations.list()
client.storage_integrations.delete("INTEGRATION_ID")Pour révoquer l’accès directement à la source, supprime plutôt la clé du compte de service dans Google Cloud.
Limites actuelles#
Les jeux de données connectés à GCS ne prennent actuellement pas en charge les fonctionnalités qui nécessitent que Platform possède des copies de tes images : l’annotation automatique, l’analyse de regroupement, le clonage de jeux de données et les instantanés de version immuables.
La suppression d’un jeu de données connecté à GCS, ou d’images individuelles qu’il contient, ne supprime que les références de Platform : tes objets ne sont jamais modifiés.
Consulte aussi les intégrations Amazon S3 et Azure Blob Storage.
FAQ#
Non. Platform liste le bucket une seule fois et indexe les dimensions des images et les étiquettes qu’elle trouve. Les originaux sont transférés à la demande pour la navigation et l’annotation, et l’entraînement géré utilise les propres copies des images épinglées de Platform uniquement pendant la durée de l’exécution. Les images indexées ne sont pas décomptées de ton quota de stockage.
Un jeu de données est indexé une seule fois lors de sa création. Les nouveaux objets ne sont pas récupérés tant que tu n’as pas créé un nouveau jeu de données ou relancé une importation échouée, et chaque image indexée est associée à sa version : si tu remplaces un objet, Platform bloque l’accès à cette image. Ajoute de nouveaux objets au lieu de remplacer ceux qui existent déjà.
Les fonctionnalités qui nécessitent que Platform possède des copies de tes images ne sont pas disponibles sur les jeux de données connectés : l’annotation automatique, l’analyse de regroupement, le clonage de jeux de données et les instantanés de version immuables. L’annotation manuelle, le partage et l’entraînement fonctionnent normalement.
Déconnecte l’intégration dans Paramètres > Intégrations pour supprimer les identifiants enregistrés, ou supprime la clé du compte de service dans Google Cloud. Aucune de ces actions ne modifie les données de tes buckets.