Integração com Azure Blob Storage#
A integração com Azure Blob Storage conecta os contêineres da sua conta de armazenamento à Ultralytics Platform. Suas imagens permanecem nos seus contêineres — a Platform as indexa no local, para que você possa navegar, anotar e treinar modelos YOLO sem enviar uma cópia.
Os conjuntos de dados do Azure Blob Storage exigem um plano Pro ou Enterprise. Os espaços de trabalho gratuitos veem a integração e recebem uma solicitação para fazer upgrade ao conectar. Os conjuntos de dados existentes do Azure Blob Storage continuam totalmente acessíveis se uma assinatura terminar — somente novas conexões e importações exigem o plano Pro.
Obter uma cadeia de conexão#
A Platform só lê os dados do seu armazenamento — nunca grava, modifica nem exclui seus blobs. A integração atual exige uma cadeia de conexão com chave de acesso à conta, que concede privilégios para toda a conta, embora a Platform use apenas operações de listagem e leitura:
- No portal do Azure, abra sua conta de armazenamento.
- Acesse Segurança + rede > Chaves de acesso.
- Copie uma cadeia de conexão.
A cadeia precisa incluir AccountName, AccountKey e HTTPS como protocolo — o formato que o Azure fornece em Chaves de
acesso. Cadeias de conexão com token SAS, que contêm SharedAccessSignature em vez de AccountKey, são rejeitadas.
As conexões usam o endpoint padrão blob.core.windows.net. Nuvens soberanas (Azure China, Azure Government) e endpoints personalizados de blobs não são compatíveis.
Conectar à Platform#
- Acesse Configurações > Integrações e selecione Azure Blob Storage na lista de integrações.
- Cole a cadeia de conexão.
- Clique em Localizar contêineres disponíveis e selecione os contêineres que deseja conectar. Você também pode digitar manualmente o nome de um contêiner.
- Clique em Conectar. Antes de salvar qualquer coisa, a Platform verifica se consegue listar e ler cada contêiner selecionado.

Você precisa da função de administrador ou proprietário do espaço de trabalho para conectar o armazenamento em nuvem. Cada conexão aceita até 50 contêineres, e a descoberta lista até 300 contêineres na conta de armazenamento.
Se você reconectar a mesma conta de armazenamento mais tarde, novos contêineres serão adicionados à integração existente. Uma credencial salva só é substituída quando a nova credencial ainda consegue ler todos os contêineres que você já conectou.
Uma chave de conta pode autorizar operações de gravação e exclusão ou criar tokens SAS se for exposta fora da Platform. As credenciais são criptografadas em repouso com AES-256-GCM, nunca são retornadas ao navegador e nunca são expostas às cargas de trabalho de treinamento. Sempre que possível, use uma conta de armazenamento dedicada. Para revogar o acesso, alterne as chaves de acesso da conta de armazenamento no Azure.
Criar um conjunto de dados a partir de um contêiner de blobs#
- Clica em New Dataset e abre o separador Cloud.
- Escolha um contêiner conectado e navegue até a pasta que contém seus dados.
- Confirma a pasta, ajusta o nome do conjunto de dados e cria-o.
A Platform lista a pasta uma vez e cria um índice do que encontra:
- Imagens — os blobs
.jpg,.jpeg,.png,.webpe.avifsão indexados com dimensões lidas por meio de solicitações limitadas. A Platform não armazena uma segunda cópia da imagem de origem. - Rótulos — os ficheiros auxiliares
.txtdo YOLO são analisados e convertidos em anotações na Platform, correspondendo ao esquema padrãoimages/→labels/ou a ficheiros na mesma pasta. - Metadados — um ficheiro YAML fornece os nomes das classes e a estrutura dos pontos-chave de pose, tal como num carregamento de arquivo. Dá-se preferência a
data.yamledata.ymlquando a pasta contém vários ficheiros. - Tarefa — uma amostra dos ficheiros de rótulos determina a tarefa, por isso as pastas de segmentação, pose e OBB são reconhecidas pela estrutura dos respetivos rótulos, e não pela tarefa escolhida na caixa de diálogo.
- Divisões — os nomes de pasta
train,valetestno caminho do blob atribuem divisões automaticamente.
A partir daí, o conjunto de dados funciona como qualquer outro: navega e anota, define-o como público ou privado, partilha-o com a tua equipa e treina com ele através do treino gerido. Os originais são transmitidos a pedido, e as imagens indexadas não consomem a tua quota de armazenamento da Platform.
Uma única importação indexa até 500.000 blobs e arquivos de rótulos ou YAML de até 1 MB cada. Contêineres maiores devem ser divididos entre vários conjuntos de dados.
Cada imagem indexada é vinculada ao ETag do seu blob, e a Platform falha de forma segura se um blob for alterado. Adicione novos blobs em vez de substituir os existentes.
Importações falhadas#
Se uma importação falhar — por causa de uma pasta vazia, um erro de digitação no caminho ou permissões revogadas —, o conjunto de dados exibirá o erro na própria página. Os editores podem clicar em Tentar importação novamente para reiniciá-la com o contêiner e a pasta salvos ou criar um novo conjunto de dados apontando para o caminho corrigido.
Uma nova tentativa lista a pasta novamente em vez de retomar a operação: os blobs adicionados desde a primeira tentativa são incluídos, e os blobs que não estão mais lá são removidos do conjunto de dados.
Treino#
O treinamento gerenciado funciona pelo fluxo normal de treinamento. Durante a execução, o treinamento usa as próprias cópias das imagens vinculadas mantidas pela Platform, e suas credenciais do Azure nunca são expostas às cargas de trabalho de treinamento.
Desconectar uma conexão#
Desconectar exclui a cadeia de conexão armazenada sem alterar nada no Azure. Os conjuntos de dados criados a partir desses contêineres permanecem no seu espaço de trabalho com suas classes, rótulos e anotações, mas não é possível carregar, visualizar ou treinar com as imagens até que a mesma conta de armazenamento seja conectada novamente.
Usa a REST API com o ID da integração devolvido por GET /api/integrations/buckets:
curl -X DELETE \
-H "Authorization: Bearer YOUR_API_KEY" \
https://platform.ultralytics.com/api/integrations/buckets/INTEGRATION_IDfrom ultralytics_platform import Platform
client = Platform() # reads ULTRALYTICS_API_KEY
integrations = client.storage_integrations.list()
client.storage_integrations.delete("INTEGRATION_ID")Para revogar o acesso diretamente na origem, alterne as chaves de acesso da conta de armazenamento no Azure.
Limitações atuais#
Os conjuntos de dados vinculados ao Azure não oferecem atualmente recursos que exigem cópias das imagens gerenciadas pela Platform: anotação automática, análise de agrupamento, clonagem de conjuntos de dados e instantâneos de versões imutáveis.
Excluir um conjunto de dados vinculado ao Azure, ou imagens individuais dele, remove apenas as referências da Platform — seus blobs nunca são alterados.
Veja também as integrações com Google Cloud Storage e Amazon S3.
Perguntas frequentes#
Não. A Platform lista o contêiner uma vez e indexa as dimensões das imagens e os rótulos encontrados. As imagens originais são transmitidas sob demanda para navegação e anotação, e o treinamento gerenciado usa as próprias cópias das imagens vinculadas da Platform apenas durante a execução. As imagens indexadas não contam para sua cota de armazenamento.
Um conjunto de dados é indexado uma única vez, quando é criado. Os novos objetos não são incluídos até criares um novo conjunto de dados ou voltares a tentar uma importação falhada, e cada imagem indexada fica associada à respetiva versão; por isso, se substituíres um objeto, a Platform falha em modo fechado nessa imagem. Adiciona novos objetos em vez de substituir os existentes.
As funcionalidades que precisam de cópias das imagens pertencentes à Platform não estão disponíveis em conjuntos de dados conectados: anotação automática, análise de agrupamento, clonagem de conjuntos de dados e instantâneos de versões imutáveis. A anotação manual, a partilha e o treino funcionam normalmente.
Desconecte a integração em Configurações > Integrações para excluir as credenciais armazenadas ou alterne as chaves de acesso da conta de armazenamento no Azure. Nenhuma das ações altera os dados nos seus contêineres.