Integración con Amazon S3#
La integración con Amazon S3 conecta tus buckets de S3 con Ultralytics Platform. Tus imágenes permanecen en tus buckets: Platform las indexa allí mismo para que puedas explorarlas, anotarlas y entrenar modelos YOLO sin cargar una copia.
Los conjuntos de datos de Amazon S3 requieren un plan Pro o Enterprise. Los espacios de trabajo gratuitos pueden ver la integración y reciben un aviso para actualizar el plan al conectarse. Los conjuntos de datos de Amazon S3 existentes siguen siendo totalmente accesibles si termina una suscripción; solo las conexiones e importaciones nuevas requieren Pro.
Crear un usuario de IAM de solo lectura#
Platform solo lee de tu almacenamiento; nunca escribe, modifica ni elimina tus objetos. Usa un usuario de IAM específico con permisos únicamente de listado y lectura; nunca uses credenciales raíz:
-
En la consola de AWS, ve a IAM > Users y crea un usuario sin acceso a la consola.
-
Asocia una política que conceda únicamente permisos de listado y lectura a los buckets que quieras conectar:
{ "Version": "2012-10-17", "Statement": [ { "Effect": "Allow", "Action": "s3:ListAllMyBuckets", "Resource": "*" }, { "Effect": "Allow", "Action": ["s3:ListBucket", "s3:GetObject"], "Resource": ["arn:aws:s3:::my-bucket", "arn:aws:s3:::my-bucket/*"] } ] }s3:ListAllMyBucketses opcional: permite que Platform descubra tus buckets para que no tengas que escribir sus nombres. -
Abre la pestaña Security credentials del usuario, crea una access key y copia el ID de la clave de acceso y la clave de acceso secreta.
Platform rechaza las credenciales temporales de AWS. Las claves emitidas por AWS STS —incluido todo lo que empiece por ASIA, las credenciales de sesión de roles
y las claves de IAM Identity Center— caducan mientras un conjunto de datos sigue conectado, por lo que se necesita una clave de acceso de larga duración de un
usuario de IAM específico.
Conéctate a Platform#
- Ve a Settings > Integrations y selecciona Amazon S3 en la lista de integraciones.
- Introduce el ID de la clave de acceso, la clave de acceso secreta y la región del bucket (por ejemplo,
us-east-1). - Haz clic en Find available buckets y selecciona los buckets que quieras conectar. Si la política no permite el descubrimiento, introduce manualmente el nombre de un bucket conocido.
- Haz clic en Conectar. Platform verifica que puede enumerar y leer cada bucket seleccionado antes de guardar nada.

Necesitas el rol de administrador o propietario del espacio de trabajo para conectar el almacenamiento en la nube. Una conexión admite hasta 50 buckets y el descubrimiento muestra hasta 300 de los buckets que la clave puede ver.
Si vuelves a conectar el mismo usuario de IAM más adelante, se añadirán nuevos buckets a la integración existente. Una credencial guardada solo se sustituye cuando su reemplazo puede seguir leyendo todos los buckets que ya hayas conectado.
Una conexión lee los buckets de la región que introduzcas. Si tus buckets están en varias regiones, crea una conexión por región.
Las credenciales se cifran en reposo con AES-256-GCM, nunca se devuelven al navegador y nunca se exponen a las cargas de trabajo de entrenamiento. Para revocar el acceso, desactiva la clave de acceso en AWS IAM.
Crear un conjunto de datos a partir de un bucket de S3#
- Haz clic en Nuevo dataset y abre la pestaña Cloud.
- Elige un bucket conectado y busca la carpeta que contiene tus datos.
- Confirma la carpeta, ajusta el nombre del dataset y créalo.
Platform enumera la carpeta una vez e indexa lo que encuentra:
- Imágenes: los objetos
.jpg,.jpeg,.png,.webpy.avifse indexan con las dimensiones leídas mediante solicitudes limitadas. Platform no conserva una segunda copia de la imagen de origen. - Etiquetas: los archivos auxiliares
.txtde YOLO se analizan como anotaciones de Platform, asociadas mediante la disposición estándarimages/→labels/o como archivos hermanos de la misma carpeta. - Metadatos: un archivo YAML proporciona los nombres de las clases y la forma de los puntos clave de pose, exactamente igual que una carga de archivo. Se prefieren
data.yamlydata.ymlcuando la carpeta contiene varios. - Tarea: una muestra de los archivos de etiquetas determina la tarea, por lo que las carpetas de segmentación, pose y OBB se reconocen por la forma de sus etiquetas, no por la tarea que elegiste en el diálogo.
- Divisiones — Los nombres de carpeta
train,valytestde la clave del objeto asignan las divisiones automáticamente.
Después, el dataset funciona como cualquier otro: explóralo y anótalo, configúralo como público o privado, compártelo con tu equipo y entrena con él mediante el entrenamiento gestionado. Los originales se transmiten bajo demanda y las imágenes indexadas no consumen tu cuota de almacenamiento de Platform.
Una sola importación indexa hasta 50.000 objetos y archivos de etiquetas o YAML de hasta 1 MB cada uno. Los buckets más grandes deben dividirse entre varios datasets.
Cada imagen indexada queda vinculada al ETag de su objeto de S3 y Platform bloquea la operación si un objeto cambia por debajo. Añade objetos nuevos en lugar de sobrescribir los existentes.
Importaciones fallidas#
Si una importación falla —por una carpeta vacía, un error tipográfico en la ruta o permisos revocados—, el dataset muestra el error en su página. Los editores pueden hacer clic en Reintentar importación para reiniciarla con el bucket y la carpeta almacenados, o crear un dataset nuevo que apunte a la ruta corregida.
Un reintento vuelve a enumerar la carpeta en lugar de reanudar la operación: se incorporan los objetos añadidos desde el primer intento y se eliminan del dataset los objetos que ya no están allí.
Entrenamiento#
El entrenamiento gestionado funciona mediante el flujo de entrenamiento normal. Durante la ejecución, el entrenamiento utiliza las copias propias de Platform de las imágenes vinculadas, y tus credenciales de AWS nunca se exponen a las cargas de trabajo de entrenamiento.
Desconecta una conexión#
Al desconectar, se eliminan las credenciales almacenadas sin modificar nada en AWS. Los conjuntos de datos creados a partir de esos buckets permanecen en tu espacio de trabajo con sus clases, etiquetas y anotaciones, pero sus imágenes no se pueden cargar, previsualizar ni utilizar para entrenar hasta que vuelvas a conectar el mismo usuario de IAM.
Usa la REST API con el ID de integración devuelto por GET /api/integrations/buckets:
curl -X DELETE \
-H "Authorization: Bearer YOUR_API_KEY" \
https://platform.ultralytics.com/api/integrations/buckets/INTEGRATION_IDfrom ultralytics_platform import Platform
client = Platform() # reads ULTRALYTICS_API_KEY
integrations = client.storage_integrations.list()
client.storage_integrations.delete("INTEGRATION_ID")Para revocar el acceso directamente desde el origen, desactiva o elimina la clave de acceso en AWS IAM.
Limitaciones actuales#
Los conjuntos de datos respaldados por S3 excluyen actualmente las funciones que requieren copias de tus imágenes propiedad de Platform: anotación automática, análisis de agrupamiento, clonación de conjuntos de datos y instantáneas de versiones inmutables.
Al eliminar un conjunto de datos respaldado por S3, o imágenes individuales del mismo, solo se eliminan las referencias de Platform; tus objetos nunca se modifican.
Consulta también las integraciones de Google Cloud Storage y Azure Blob Storage.
Preguntas frecuentes#
No. Platform enumera el bucket una sola vez e indexa las dimensiones y las etiquetas de las imágenes que encuentra. Las originales se transmiten bajo demanda para la exploración y la anotación, y el entrenamiento gestionado funciona a partir de las copias propias de Platform de las imágenes fijadas únicamente durante la duración de la ejecución. Las imágenes indexadas no computan en tu cuota de almacenamiento.
Un conjunto de datos se indexa una sola vez cuando se crea. Los objetos nuevos no se detectan hasta que creas un conjunto de datos nuevo o reintentas una importación fallida, y cada imagen indexada está fijada a su versión, por lo que sobrescribir un objeto hace que Platform falle de forma segura en esa imagen. Añade objetos nuevos en lugar de reemplazar los existentes.
Las funciones que necesitan copias de tus imágenes propiedad de Platform se excluyen en los conjuntos de datos conectados: la anotación automática, el análisis de agrupamiento, la clonación de conjuntos de datos y las instantáneas de versión inmutables. La anotación manual, el uso compartido y el entrenamiento funcionan con total normalidad.
Desconecta la integración en Settings > Integrations para eliminar las credenciales almacenadas, o desactiva o elimina la clave de acceso en AWS IAM. Ninguna de las dos acciones afecta a los datos de tus buckets.