Integración con Amazon S3#
La integración de Amazon S3 conecta tus buckets de S3 con Ultralytics Platform. Tus imágenes permanecen en tus buckets; Platform las indexa en su lugar, para que puedas explorar, anotar y entrenar modelos YOLO sin subir una copia.
Los datasets de Amazon S3 requieren un Pro or Enterprise plan. Los espacios de trabajo gratuitos ven la integración y se les pide que actualicen al conectarse. Los datasets existentes de Amazon S3 siguen siendo totalmente accesibles si finaliza una suscripción; solo las nuevas conexiones e importaciones requieren Pro.
Crea un usuario de IAM de solo lectura#
Platform solo lee de tu almacenamiento; nunca escribe, modifica ni elimina tus objetos. Utiliza un IAM user dedicado únicamente con acceso de lista y lectura; nunca utilices credenciales de root:
-
En la consola de AWS, ve a IAM > Users y crea un usuario sin acceso a la consola.
-
Adjunta una política que conceda únicamente acceso de lectura y listado a los buckets que quieras conectar:
{ "Version": "2012-10-17", "Statement": [ { "Effect": "Allow", "Action": "s3:ListAllMyBuckets", "Resource": "*" }, { "Effect": "Allow", "Action": ["s3:ListBucket", "s3:GetObject"], "Resource": ["arn:aws:s3:::my-bucket", "arn:aws:s3:::my-bucket/*"] } ] }s3:ListAllMyBucketses opcional; permite que Platform descubra tus buckets para que no tengas que escribir sus nombres. -
Abre la pestaña Security credentials del usuario, crea una access key y copia el access key ID y la secret access key.
Platform rechaza las credenciales temporales de AWS. Las claves emitidas por AWS STS —incluyendo cualquier cosa que comience con ASIA, las credenciales de sesión de rol y las claves de IAM Identity Center— caducan mientras un conjunto de datos sigue conectado, por lo que se requiere la clave de acceso de larga duración de un usuario IAM dedicado.
Conéctate a Platform#
- Ve a Settings > Integrations y selecciona Amazon S3 en la lista de integraciones.
- Introduce el ID de clave de acceso, la clave de acceso secreta y la región del bucket (por ejemplo,
us-east-1). - Haz clic en Find available buckets y selecciona los buckets que deseas conectar. Si la política no permite el descubrimiento, introduce un nombre de bucket conocido manualmente.
- Haz clic en Conectar. Platform verificará que puede enumerar y leer cada bucket seleccionado antes de guardar nada.

Necesitas el rol de administrador o propietario del espacio de trabajo para conectar el almacenamiento en la nube. Una conexión admite hasta 50 buckets y el descubrimiento lista hasta 300 de los buckets que la clave puede ver.
Volver a conectar el mismo usuario de IAM más tarde añade nuevos buckets a la integración existente. Una credencial guardada solo se reemplaza una vez que su reemplazo pueda seguir leyendo todos los buckets que ya habías conectado.
Una conexión lee los buckets de la región que introduzcas. Si tus buckets residen en varias regiones, conéctate una vez por cada región.
Las credenciales se cifran en reposo con AES-256-GCM, nunca se devuelven al navegador y nunca se exponen a las cargas de trabajo de entrenamiento. Para revocar el acceso, desactiva la clave de acceso en AWS IAM.
Crea un dataset desde un bucket de S3#
- Haz clic en New Dataset y abre la pestaña Cloud.
- Elige un bucket conectado y navega hasta la carpeta que contiene tus datos.
- Confirma la carpeta, ajusta el nombre del conjunto de datos y créalo.
La plataforma lista la carpeta una vez e indexa lo que encuentra:
- Images: los objetos
.jpg,.jpeg,.png,.webpy.avifse indexan con dimensiones leídas mediante solicitudes acotadas. Platform no almacena una segunda copia de la imagen de origen. - Labels: los archivos adjuntos de YOLO
.txtse analizan para convertirlos en anotaciones de Platform, emparejados según la estructura estándarimages/→labels/o como elementos hermanos en la misma carpeta. - Metadata: un archivo YAML proporciona los nombres de las clases y la forma de los keypoints de pose, exactamente igual que en una subida de archivo comprimido. Se prefieren
data.yamlydata.ymlcuando la carpeta contiene varios. - Task: una muestra de los archivos de etiquetas determina la tarea, por lo que las carpetas de segmentación, pose y OBB se reconocen por la forma de sus etiquetas en lugar de por la tarea que elegiste en el cuadro de diálogo.
- Splits — Los nombres de carpeta
train,valytesten la clave del objeto asignan las divisiones automáticamente.
El dataset se comporta entonces como cualquier otro: explóralo y anótalo, configúralo como público o privado, compártelo con tu equipo y entrena con él mediante el entrenamiento administrado. Los originales se transmiten bajo demanda y las imágenes indexadas no consumen tu cuota de almacenamiento de Platform.
Una única importación indexa hasta 50 000 objetos y archivos de etiquetas o YAML de hasta 1 MB cada uno. Los buckets más grandes deben dividirse en varios datasets.
Cada imagen indexada se vincula al ETag de su objeto S3, y Platform se detiene si un objeto cambia subyacente. Añade nuevos objetos en lugar de sobrescribir los existentes.
Importaciones fallidas#
Si una importación falla (una carpeta vacía, un error tipográfico en la ruta o permisos revocados), el dataset muestra el error en su página. Los editores pueden hacer clic en Reintentar importación para reiniciarla con el bucket y la carpeta almacenados, o crear un nuevo dataset que apunte a la ruta corregida.
Un reintento vuelve a listar la carpeta en lugar de reanudarse: los objetos añadidos desde el primer intento se incluyen, y los objetos que ya no están se eliminan del dataset.
Entrenamiento#
El entrenamiento administrado funciona a través del flujo de entrenamiento normal. El entrenamiento utiliza las copias propias de Platform de las imágenes fijadas durante la duración de la ejecución, y tus credenciales de AWS nunca se exponen a las cargas de trabajo de entrenamiento.
Desconectar una conexión#
La desconexión elimina las credenciales almacenadas sin tocar nada en AWS. Los conjuntos de datos creados a partir de esos buckets permanecen en tu espacio de trabajo con sus clases, etiquetas y anotaciones, pero sus imágenes no se pueden cargar, previsualizar ni utilizar para entrenar hasta que se vuelva a conectar el mismo usuario IAM.
Usa la REST API con el ID de integración devuelto por GET /api/integrations/buckets:
curl -X DELETE \
-H "Authorization: Bearer YOUR_API_KEY" \
https://platform.ultralytics.com/api/integrations/buckets/INTEGRATION_IDfrom ultralytics_platform import Platform
client = Platform() # reads ULTRALYTICS_API_KEY
integrations = client.storage_integrations.list()
client.storage_integrations.delete("INTEGRATION_ID")Para revocar el acceso en el origen en su lugar, desactiva o elimina la clave de acceso en AWS IAM.
Limitaciones actuales#
Los datasets respaldados por S3 actualmente excluyen las características que requieren copias de tus imágenes propiedad de Platform: anotación automática, clustering analysis, clonación de datasets e version snapshots inmutables.
Eliminar un dataset respaldado por S3, o imágenes individuales del mismo, solo elimina las referencias de Platform; tus objetos nunca se ven afectados.
Consulta también las integraciones de Google Cloud Storage y Azure Blob Storage.