Ultralytics YOLO27:

Integración de Azure Blob Storage#

La integración con Azure Blob Storage conecta los contenedores de tu cuenta de almacenamiento con Ultralytics Platform. Tus imágenes permanecen en tus contenedores: Platform las indexa allí mismo, para que puedas explorarlas, anotarlas y entrenar modelos YOLO sin subir una copia.

Función Pro

Los conjuntos de datos de Azure Blob Storage requieren un plan Pro o Enterprise. Los espacios de trabajo gratuitos ven la integración y reciben un aviso para cambiar de plan al intentar conectarse. Los conjuntos de datos existentes de Azure Blob Storage siguen siendo totalmente accesibles si finaliza una suscripción; solo las conexiones e importaciones nuevas requieren Pro.

Obtener una cadena de conexión#

Platform solo lee de tu almacenamiento; nunca escribe, modifica ni elimina tus blobs. La integración actual requiere una cadena de conexión con clave de acceso de la cuenta, que concede privilegios en toda la cuenta aunque Platform solo realice operaciones de lectura y enumeración:

  1. En el portal de Azure, abre tu cuenta de almacenamiento.
  2. Ve a Seguridad y redes > Claves de acceso.
  3. Copia una cadena de conexión.

La cadena debe incluir AccountName, AccountKey y HTTPS como protocolo, en el formato que Azure te proporciona en Claves de acceso. Se rechazan las cadenas de conexión con tokens SAS, que contienen SharedAccessSignature en lugar de AccountKey.

Solo se admite la nube pública de Azure

Las conexiones utilizan el punto de conexión estándar blob.core.windows.net. No se admiten nubes soberanas (Azure China, Azure Government) ni puntos de conexión de blobs personalizados.

Conéctate a Platform#

  1. Ve a Configuración > Integraciones y selecciona Azure Blob Storage en la lista de integraciones.
  2. Pega la cadena de conexión.
  3. Haz clic en Buscar contenedores disponibles y selecciona los contenedores que quieras conectar. También puedes introducir manualmente el nombre de un contenedor.
  4. Haz clic en Conectar. Platform comprueba que puede enumerar y leer cada contenedor seleccionado antes de guardar nada.

Configuración de la integración de Azure Blob Storage en Ultralytics Platform

Necesitas el rol de administrador o propietario del espacio de trabajo para conectar almacenamiento en la nube. Cada conexión admite hasta 50 contenedores y la búsqueda muestra hasta 300 contenedores de la cuenta de almacenamiento.

Si vuelves a conectar la misma cuenta de almacenamiento más adelante, se añadirán los contenedores nuevos a la integración existente. Una credencial guardada solo se sustituye cuando la nueva sigue permitiendo leer todos los contenedores que ya habías conectado.

Seguridad de las credenciales

Una clave de cuenta puede autorizar operaciones de escritura y eliminación, o crear tokens SAS si se expone fuera de Platform. Las credenciales se cifran en reposo con AES-256-GCM, nunca se devuelven al navegador y nunca se exponen a las cargas de trabajo de entrenamiento. Cuando sea posible, utiliza una cuenta de almacenamiento específica para este fin. Para revocar el acceso, cambia las claves de acceso de la cuenta de almacenamiento en Azure.

Crear un conjunto de datos a partir de un contenedor de blobs#

  1. Haz clic en New Dataset y abre la pestaña Cloud.
  2. Elige un contenedor conectado y ve a la carpeta que contiene tus datos.
  3. Confirma la carpeta, ajusta el nombre del conjunto de datos y créalo.

Platform enumera la carpeta una vez e indexa lo que encuentra:

  • Imágenes: los blobs .jpg, .jpeg, .png, .webp y .avif se indexan y sus dimensiones se leen mediante solicitudes acotadas. Platform no guarda una segunda copia de la imagen de origen.
  • Etiquetas — Los archivos asociados .txt de YOLO se analizan y se convierten en anotaciones de Platform, que se emparejan mediante la estructura estándar images/ → labels/ o como archivos hermanos en la misma carpeta.
  • Metadatos — Un archivo YAML proporciona los nombres de las clases y la forma de los puntos clave de pose, igual que al subir un archivo. Se da preferencia a data.yaml y data.yml si la carpeta contiene varios.
  • Tarea — Una muestra de los archivos de etiquetas determina la tarea, por lo que las carpetas de segmentación, pose y OBB se reconocen por la forma de sus etiquetas, no por la tarea que hayas elegido en el cuadro de diálogo.
  • Divisiones: los nombres de carpeta train, val y test en la ruta del blob asignan automáticamente las divisiones.

Después, el conjunto de datos funciona como cualquier otro: puedes explorarlo y anotarlo, establecerlo como público o privado, compartirlo con tu equipo y entrenar con él mediante el entrenamiento gestionado. Los originales se transmiten bajo demanda y las imágenes indexadas no consumen tu cuota de almacenamiento de Platform.

Límites

Una importación indexa hasta 500 000 blobs y archivos de etiquetas o YAML de hasta 1 MB cada uno. Los contenedores más grandes deben dividirse entre varios conjuntos de datos.

Mantén inmutables los blobs indexados

Cada imagen indexada queda asociada a la etiqueta ETag de su blob, y Platform falla de forma segura si el blob cambia. Añade blobs nuevos en lugar de sobrescribir los existentes.

Importaciones fallidas#

Si falla una importación —por una carpeta vacía, un error tipográfico en la ruta o permisos revocados—, el conjunto de datos muestra el error en su página. Los editores pueden hacer clic en Reintentar importación para reiniciarla con el contenedor y la carpeta guardados, o crear un conjunto de datos nuevo que apunte a la ruta corregida.

Al reintentar, se vuelve a enumerar la carpeta en lugar de reanudar la importación: se incluyen los blobs añadidos desde el primer intento y se eliminan del conjunto de datos los que ya no están.

Entrenamiento#

El entrenamiento gestionado funciona mediante el flujo de entrenamiento habitual. Durante la ejecución, el entrenamiento utiliza las propias copias de las imágenes fijadas de Platform, y tus credenciales de Azure nunca se exponen a las cargas de trabajo de entrenamiento.

Desconecta una conexión#

Al desconectar, se elimina la cadena de conexión guardada sin modificar nada en Azure. Los conjuntos de datos creados a partir de esos contenedores permanecen en tu espacio de trabajo con sus clases, etiquetas y anotaciones, pero sus imágenes no se pueden cargar, previsualizar ni usar para entrenar hasta que se vuelva a conectar la misma cuenta de almacenamiento.

Usa la REST API con el ID de integración devuelto por GET /api/integrations/buckets:

curl -X DELETE \
  -H "Authorization: Bearer YOUR_API_KEY" \
  https://platform.ultralytics.com/api/integrations/buckets/INTEGRATION_ID
from ultralytics_platform import Platform

client = Platform()  # reads ULTRALYTICS_API_KEY
integrations = client.storage_integrations.list()
client.storage_integrations.delete("INTEGRATION_ID")

Para revocar el acceso en el origen, cambia las claves de acceso de la cuenta de almacenamiento en Azure.

Limitaciones actuales#

Actualmente, los conjuntos de datos basados en Azure no admiten funciones que requieren copias de tus imágenes almacenadas en Platform: anotación automática, análisis de agrupamiento, clonación de conjuntos de datos e instantáneas de versiones inmutables.

Al eliminar un conjunto de datos basado en Azure, o imágenes individuales de este, solo se eliminan las referencias de Platform; tus blobs no se modifican.

Consulta también las integraciones de Google Cloud Storage y Amazon S3.

Preguntas frecuentes#

  • No. Platform enumera el contenedor una vez e indexa las dimensiones de las imágenes y las etiquetas que encuentra. Los originales se transmiten bajo demanda para explorarlos y anotarlos, y el entrenamiento gestionado utiliza las propias copias de las imágenes fijadas de Platform solo durante la ejecución. Las imágenes indexadas no cuentan para tu cuota de almacenamiento.

  • Un conjunto de datos se indexa una sola vez, al crearlo. Los objetos nuevos no se incorporan hasta que crees un conjunto de datos nuevo o reintentes una importación fallida, y cada imagen indexada queda vinculada a su versión, por lo que, si sobrescribes un objeto, Platform falla de forma segura al acceder a esa imagen. Añade objetos nuevos en lugar de sustituir los existentes.

  • Los conjuntos de datos conectados no incluyen las funciones que necesitan copias de tus imágenes gestionadas por Platform: anotación automática, análisis de agrupamiento, clonación de conjuntos de datos e instantáneas de versiones inmutables. La anotación manual, el uso compartido y el entrenamiento funcionan con normalidad.

  • Desconecta la integración en Configuración > Integraciones para eliminar las credenciales guardadas, o cambia las claves de acceso de la cuenta de almacenamiento en Azure. Ninguna de estas acciones modifica los datos de tus contenedores.

Comentarios