YOLO Vision 2026:

Integración con Azure Blob Storage#

La integración con Azure Blob Storage conecta los contenedores de tu cuenta de almacenamiento con Ultralytics Platform. Tus imágenes permanecen en tus contenedores; Platform las indexa allí mismo para que puedas explorarlas, anotarlas y entrenar modelos YOLO sin cargar una copia.

Función Pro

Los conjuntos de datos de Azure Blob Storage requieren un plan Pro o Enterprise. Los espacios de trabajo gratuitos muestran la integración y te piden que actualices el plan al conectarte. Los conjuntos de datos de Azure Blob Storage existentes siguen siendo totalmente accesibles si finaliza una suscripción; solo las conexiones e importaciones nuevas requieren Pro.

Obtener una cadena de conexión#

Platform solo lee de tu almacenamiento; nunca escribe, modifica ni elimina tus blobs. La integración actual requiere una cadena de conexión con la clave de acceso de la cuenta, que concede privilegios para toda la cuenta aunque Platform solo utiliza operaciones de listado y lectura:

  1. En el portal de Azure, abre tu cuenta de almacenamiento.
  2. Ve a Seguridad y redes > Claves de acceso.
  3. Copia una cadena de conexión.

La cadena debe incluir AccountName, AccountKey y HTTPS como protocolo —el formato que Azure te proporciona en Claves de acceso. Las cadenas de conexión con un token SAS, que contienen SharedAccessSignature en lugar de AccountKey, se rechazan.

Solo la nube pública de Azure

Las conexiones utilizan el endpoint estándar blob.core.windows.net. Las nubes soberanas (Azure China, Azure Government) y los endpoints de blobs personalizados no son compatibles.

Conéctate a Platform#

  1. Ve a Configuración > Integraciones y selecciona Azure Blob Storage en la lista de integraciones.
  2. Pega la cadena de conexión.
  3. Haz clic en Buscar contenedores disponibles y selecciona los contenedores que quieras conectar. También puedes introducir manualmente el nombre de un contenedor .
  4. Haz clic en Conectar. Platform verifica que puede enumerar y leer cada contenedor seleccionado antes de guardar nada.

Configuración de la integración de Azure Blob Storage de Ultralytics Platform

Necesitas el rol de administrador o propietario del espacio de trabajo para conectar el almacenamiento en la nube. Una conexión admite hasta 50 contenedores y la detección muestra hasta 300 contenedores de la cuenta de almacenamiento.

Si vuelves a conectar la misma cuenta de almacenamiento más adelante, se añadirán contenedores nuevos a la integración existente. Una credencial guardada solo se sustituye cuando su reemplazo puede seguir leyendo todos los contenedores que ya has conectado.

Seguridad de las credenciales

Una clave de cuenta puede autorizar operaciones de escritura y eliminación, o crear tokens SAS si se expone fuera de Platform. Las credenciales se cifran en reposo con AES-256-GCM, nunca se devuelven al navegador y nunca se exponen a las cargas de trabajo de entrenamiento. Cuando sea posible, utiliza una cuenta de almacenamiento dedicada. Para revocar el acceso, rota las claves de acceso de la cuenta de almacenamiento en Azure.

Crear un conjunto de datos a partir de un contenedor de blobs#

  1. Haz clic en Nuevo dataset y abre la pestaña Cloud.
  2. Selecciona un contenedor conectado y desplázate hasta la carpeta que contiene tus datos.
  3. Confirma la carpeta, ajusta el nombre del dataset y créalo.

Platform enumera la carpeta una vez e indexa lo que encuentra:

  • Imágenes — Los blobs .jpg, .jpeg, .png, .webp y .avif se indexan con las dimensiones obtenidas mediante solicitudes limitadas. Platform no conserva una segunda copia de la imagen de origen.
  • Etiquetas: los archivos auxiliares .txt de YOLO se analizan como anotaciones de Platform, asociadas mediante la disposición estándar images/labels/ o como archivos hermanos de la misma carpeta.
  • Metadatos: un archivo YAML proporciona los nombres de las clases y la forma de los puntos clave de pose, exactamente igual que una carga de archivo. Se prefieren data.yaml y data.yml cuando la carpeta contiene varios.
  • Tarea: una muestra de los archivos de etiquetas determina la tarea, por lo que las carpetas de segmentación, pose y OBB se reconocen por la forma de sus etiquetas, no por la tarea que elegiste en el diálogo.
  • Divisiones — Los nombres de carpeta train, val y test de la ruta del blob asignan las divisiones automáticamente.

Después, el dataset funciona como cualquier otro: explóralo y anótalo, configúralo como público o privado, compártelo con tu equipo y entrena con él mediante el entrenamiento gestionado. Los originales se transmiten bajo demanda y las imágenes indexadas no consumen tu cuota de almacenamiento de Platform.

Límites

Una sola importación indexa hasta 50.000 blobs y archivos de etiquetas o YAML de hasta 1 MB cada uno. Los contenedores más grandes deben dividirse entre varios conjuntos de datos.

Mantén inmutables los blobs indexados

Cada imagen indexada queda vinculada a la etiqueta ETag de su blob y Platform falla de forma segura si un blob cambia por debajo. Añade blobs nuevos en lugar de sobrescribir los existentes.

Importaciones fallidas#

Si falla una importación —por una carpeta vacía, un error tipográfico en la ruta o permisos revocados—, el conjunto de datos muestra el error en su página. Los editores pueden hacer clic en Reintentar importación para reiniciarla con el contenedor y la carpeta almacenados, o crear un conjunto de datos nuevo que apunte a la ruta corregida.

Un reintento vuelve a enumerar la carpeta en lugar de reanudar la operación: se incorporan los blobs añadidos desde el primer intento y se eliminan del conjunto de datos los blobs que ya no están allí.

Entrenamiento#

El entrenamiento gestionado funciona mediante el flujo de entrenamiento habitual. Durante la ejecución, el entrenamiento utiliza las propias copias de Platform de las imágenes fijadas, y tus credenciales de Azure nunca se exponen a las cargas de trabajo de entrenamiento.

Desconecta una conexión#

Al desconectar se elimina la cadena de conexión almacenada sin tocar nada en Azure. Los conjuntos de datos creados a partir de esos contenedores permanecen en tu espacio de trabajo con sus clases, etiquetas y anotaciones, pero sus imágenes no se pueden cargar, previsualizar ni utilizar para entrenar hasta que se vuelva a conectar la misma cuenta de almacenamiento.

Usa la REST API con el ID de integración devuelto por GET /api/integrations/buckets:

curl -X DELETE \
  -H "Authorization: Bearer YOUR_API_KEY" \
  https://platform.ultralytics.com/api/integrations/buckets/INTEGRATION_ID
from ultralytics_platform import Platform

client = Platform()  # reads ULTRALYTICS_API_KEY
integrations = client.storage_integrations.list()
client.storage_integrations.delete("INTEGRATION_ID")

Para revocar el acceso directamente en el origen, rota las claves de acceso de la cuenta de almacenamiento en Azure.

Limitaciones actuales#

Actualmente, los conjuntos de datos respaldados por Azure excluyen las funciones que requieren copias de tus imágenes propiedad de Platform: anotación automática, análisis de agrupamiento, clonación de conjuntos de datos y instantáneas de versiones inmutables.

Al eliminar un conjunto de datos respaldado por Azure, o imágenes individuales de este, solo se eliminan las referencias de Platform; tus blobs nunca se tocan.

Consulta también las integraciones de Google Cloud Storage y Amazon S3.

Preguntas frecuentes#

  • No. Platform enumera el contenedor una vez e indexa las dimensiones de las imágenes y las etiquetas que encuentra. Las originales se transmiten bajo demanda para la exploración y la anotación, y el entrenamiento gestionado funciona a partir de las copias propias de Platform de las imágenes fijadas únicamente durante la duración de la ejecución. Las imágenes indexadas no cuentan para tu cuota de almacenamiento.

  • Un conjunto de datos se indexa una sola vez cuando se crea. Los objetos nuevos no se detectan hasta que creas un conjunto de datos nuevo o reintentas una importación fallida, y cada imagen indexada está fijada a su versión, por lo que sobrescribir un objeto hace que Platform falle de forma segura en esa imagen. Añade objetos nuevos en lugar de reemplazar los existentes.

  • Las funciones que necesitan copias de tus imágenes propiedad de Platform se excluyen en los conjuntos de datos conectados: la anotación automática, el análisis de agrupamiento, la clonación de conjuntos de datos y las instantáneas de versión inmutables. La anotación manual, el uso compartido y el entrenamiento funcionan con total normalidad.

  • Desconecta la integración en Settings > Integrations para eliminar las credenciales almacenadas, o rota las claves de acceso de la cuenta de almacenamiento en Azure. Ninguna de las dos acciones afecta a los datos de tus contenedores.

Colaboradores

Comentarios