Integración con Google Cloud Storage#
La integración con Google Cloud Storage conecta tus buckets de GCS con Ultralytics Platform. Tus imágenes permanecen en tus buckets: Platform las indexa directamente, para que puedas explorarlas, anotarlas y entrenar modelos YOLO sin subir una copia.
Los conjuntos de datos de Google Cloud Storage requieren un plan Pro o Enterprise. Los espacios de trabajo gratuitos ven la integración y reciben un aviso para cambiar de plan al conectarse. Los conjuntos de datos de Google Cloud Storage existentes siguen siendo totalmente accesibles si termina una suscripción; solo las conexiones e importaciones nuevas requieren Pro.
Crea una cuenta de servicio de solo lectura#
Platform solo lee de tu almacenamiento: nunca escribe, modifica ni elimina tus objetos. Crea una cuenta de servicio dedicada con acceso de solo lectura:
- En la consola de Google Cloud, ve a IAM & Admin > Service Accounts y crea una cuenta de servicio.
- Asigna el rol Storage Object Viewer (
roles/storage.objectViewer) a los buckets que quieras conectar. - Abre la cuenta de servicio, selecciona Keys > Add key > Create new key, elige JSON y descarga el archivo de clave.
roles/storage.objectViewer cubre todo lo que Platform hace con tus datos, pero no permite enumerar los
buckets de un proyecto. Añade un rol que incluya storage.buckets.list si quieres que Platform encuentre tus buckets;
de lo contrario, escribe manualmente el nombre de cada bucket al conectarlo.
Conéctate a Platform#
- Ve a Settings > Integrations y selecciona Google Cloud Storage en la lista de integraciones.
- Pega el contenido de la clave JSON de la cuenta de servicio.
- Haz clic en Find available buckets y selecciona los buckets que quieras conectar. Si la cuenta de servicio no puede enumerar los buckets, introduce manualmente el nombre de un bucket que conozcas.
- Haz clic en Connect. Platform comprueba que puede enumerar y leer cada bucket seleccionado antes de guardar nada.

Necesitas el rol de administrador o propietario del espacio de trabajo para conectar el almacenamiento en la nube. Una conexión admite hasta 50 buckets, y la detección muestra hasta 300 de los buckets que puede ver la cuenta de servicio.
Tu navegador lee el archivo de clave que has pegado y envía solo los tres campos que necesita Platform: client_email, private_key,
y project_id. El resto del JSON nunca sale de la página.
Si vuelves a conectar la misma cuenta de servicio más adelante, se añadirán nuevos buckets a la integración existente. Una credencial guardada solo se sustituye cuando se comprueba que la nueva credencial puede seguir leyendo todos los buckets que ya has conectado.
Las credenciales se cifran en reposo con AES-256-GCM, nunca se devuelven al navegador ni se exponen a las cargas de trabajo de entrenamiento. Para revocar el acceso, elimina la clave de la cuenta de servicio en Google Cloud.
Crea un conjunto de datos a partir de un bucket de GCS#
- Haz clic en New Dataset y abre la pestaña Cloud.
- Elige un bucket conectado y busca la carpeta que contiene tus datos.
- Confirma la carpeta, ajusta el nombre del conjunto de datos y créalo.
Platform enumera la carpeta una vez e indexa lo que encuentra:
- Imágenes — Los objetos
.jpg,.jpeg,.png,.webpy.avifse indexan con las dimensiones obtenidas mediante solicitudes acotadas. Platform no guarda una segunda copia de la imagen de origen. - Etiquetas — Los archivos asociados
.txtde YOLO se analizan y se convierten en anotaciones de Platform, que se emparejan mediante la estructura estándarimages/→labels/o como archivos hermanos en la misma carpeta. - Metadatos — Un archivo YAML proporciona los nombres de las clases y la forma de los puntos clave de pose, igual que al subir un archivo. Se da preferencia a
data.yamlydata.ymlsi la carpeta contiene varios. - Tarea — Una muestra de los archivos de etiquetas determina la tarea, por lo que las carpetas de segmentación, pose y OBB se reconocen por la forma de sus etiquetas, no por la tarea que hayas elegido en el cuadro de diálogo.
- Divisiones — Los nombres de carpeta
train,valytestde la ruta del objeto asignan las divisiones automáticamente.
Después, el conjunto de datos funciona como cualquier otro: puedes explorarlo y anotarlo, establecerlo como público o privado, compartirlo con tu equipo y entrenar con él mediante el entrenamiento gestionado. Los originales se transmiten bajo demanda y las imágenes indexadas no consumen tu cuota de almacenamiento de Platform.
Una sola importación indexa hasta 500 000 objetos, y archivos de etiquetas o YAML de hasta 1 MB cada uno. Los buckets más grandes deben dividirse en varios conjuntos de datos.
Cada imagen indexada queda vinculada a la generación de su objeto de GCS, y Platform falla de forma segura si el objeto cambia. Añade objetos nuevos en lugar de sobrescribir los existentes.
Importaciones fallidas#
Si falla una importación —por una carpeta vacía, un error tipográfico en la ruta o permisos revocados—, el conjunto de datos muestra el error en su página. Los editores pueden hacer clic en Retry import para reiniciarla con el bucket y la carpeta guardados, o crear un nuevo conjunto de datos que apunte a la ruta corregida.
Al reintentar, se vuelve a enumerar la carpeta en lugar de reanudar la importación: se incorporan los objetos añadidos desde el primer intento y se descartan los que ya no están.
Entrenamiento#
El entrenamiento gestionado funciona con el flujo de entrenamiento habitual. Durante la ejecución, el entrenamiento usa copias propias de Platform de las imágenes fijadas, y tus credenciales de Google Cloud nunca se exponen a las cargas de trabajo de entrenamiento.
Desconecta una conexión#
Al desconectarte, se eliminan las credenciales guardadas sin modificar nada en Google Cloud. Los conjuntos de datos creados a partir de esos buckets permanecen en tu espacio de trabajo con sus clases, etiquetas y anotaciones, pero sus imágenes no se pueden cargar, previsualizar ni usar para entrenar hasta que vuelvas a conectar la misma cuenta de servicio.
Usa la REST API con el ID de integración devuelto por GET /api/integrations/buckets:
curl -X DELETE \
-H "Authorization: Bearer YOUR_API_KEY" \
https://platform.ultralytics.com/api/integrations/buckets/INTEGRATION_IDfrom ultralytics_platform import Platform
client = Platform() # reads ULTRALYTICS_API_KEY
integrations = client.storage_integrations.list()
client.storage_integrations.delete("INTEGRATION_ID")Para revocar el acceso directamente en el origen, elimina la clave de la cuenta de servicio en Google Cloud.
Limitaciones actuales#
Los conjuntos de datos vinculados a GCS no incluyen actualmente las funciones que requieren copias de tus imágenes gestionadas por Platform: anotación automática, análisis de agrupamiento, clonación de conjuntos de datos e instantáneas de versiones inmutables.
Si eliminas un conjunto de datos vinculado a GCS o imágenes concretas de él, solo se eliminan las referencias de Platform: tus objetos nunca se modifican.
Consulta también las integraciones de Amazon S3 y Azure Blob Storage.
Preguntas frecuentes#
No. Platform enumera el bucket una vez e indexa las dimensiones de las imágenes y las etiquetas que encuentra. Los originales se transmiten bajo demanda para explorarlos y anotarlos, y el entrenamiento gestionado utiliza copias propias de Platform de las imágenes fijadas solo durante la ejecución. Las imágenes indexadas no cuentan para tu cuota de almacenamiento.
Un conjunto de datos se indexa una sola vez, al crearlo. Los objetos nuevos no se incorporan hasta que crees un conjunto de datos nuevo o reintentes una importación fallida, y cada imagen indexada queda vinculada a su versión, por lo que, si sobrescribes un objeto, Platform falla de forma segura al acceder a esa imagen. Añade objetos nuevos en lugar de sustituir los existentes.
Los conjuntos de datos conectados no incluyen las funciones que necesitan copias de tus imágenes gestionadas por Platform: anotación automática, análisis de agrupamiento, clonación de conjuntos de datos e instantáneas de versiones inmutables. La anotación manual, el uso compartido y el entrenamiento funcionan con normalidad.
Desconecta la integración en Settings > Integrations para eliminar las credenciales guardadas, o elimina la clave de la cuenta de servicio en Google Cloud. Ninguna de estas acciones modifica los datos de tus buckets.