YOLO Vision 2026:

Integração com Amazon S3#

A integração com o Amazon S3 conecta seus buckets do S3 à Ultralytics Platform. Suas imagens permanecem nos seus buckets — a Platform as indexa no local, para que você possa navegar, anotar e treinar modelos YOLO sem enviar uma cópia.

Funcionalidade Pro

Os conjuntos de dados do Amazon S3 exigem um plano Pro ou Enterprise. Os espaços de trabalho gratuitos veem a integração e são solicitados a fazer upgrade ao conectar. Os conjuntos de dados existentes do Amazon S3 permanecem totalmente acessíveis se uma assinatura terminar — apenas novas conexões e importações exigem o plano Pro.

Criar um usuário IAM somente leitura#

A Platform apenas lê seu armazenamento — ela nunca grava, modifica ou exclui seus objetos. Use um usuário IAM dedicado com acesso somente para listar e ler — nunca use credenciais root:

  1. No console da AWS, acesse IAM > Users e crie um usuário sem acesso ao console.

  2. Anexe uma política que conceda apenas acesso para listar e ler os buckets que você deseja conectar:

    {
        "Version": "2012-10-17",
        "Statement": [
            { "Effect": "Allow", "Action": "s3:ListAllMyBuckets", "Resource": "*" },
            {
                "Effect": "Allow",
                "Action": ["s3:ListBucket", "s3:GetObject"],
                "Resource": ["arn:aws:s3:::my-bucket", "arn:aws:s3:::my-bucket/*"]
            }
        ]
    }

    s3:ListAllMyBuckets é opcional — ele permite que a Platform descubra seus buckets, para que você não precise digitar os nomes.

  3. Abra a aba Security credentials do usuário, crie uma access key e copie o ID da chave de acesso e a chave de acesso secreta.

Somente chaves de usuário IAM de longa duração

A Platform rejeita credenciais temporárias da AWS. As chaves emitidas pelo AWS STS — incluindo qualquer chave que comece com ASIA, credenciais de sessão de função e chaves do IAM Identity Center — expiram enquanto um conjunto de dados ainda está conectado, portanto é necessária a chave de acesso de longa duração de um usuário IAM dedicado.

Ligar à Platform#

  1. Acesse Settings > Integrations e selecione Amazon S3 na lista de integrações.
  2. Insira o ID da chave de acesso, a chave de acesso secreta e a região do bucket (por exemplo, us-east-1).
  3. Clique em Find available buckets e selecione os buckets a conectar. Se a política não permitir a descoberta, insira manualmente o nome de um bucket conhecido.
  4. Clica em Connect. A Platform verifica se consegue listar e ler cada bucket selecionado antes de guardar qualquer informação.

Configurações da integração do Amazon S3 na Ultralytics Platform

Você precisa da função de administrador ou proprietário do espaço de trabalho para conectar o armazenamento em nuvem. Uma conexão comporta até 50 buckets, e a descoberta lista até 300 dos buckets que a chave pode acessar.

Conectar o mesmo usuário IAM novamente mais tarde adiciona novos buckets à integração existente. Uma credencial salva só é substituída quando a credencial substituta ainda consegue ler todos os buckets que você já conectou.

Uma região por conexão

Uma conexão lê os buckets na região que você inserir. Se seus buckets estiverem em várias regiões, conecte-se uma vez por região.

Segurança das credenciais

As credenciais são criptografadas em repouso com AES-256-GCM, nunca são retornadas ao navegador e nunca são expostas às cargas de trabalho de treinamento. Para revogar o acesso, desative a chave de acesso no AWS IAM.

Criar um conjunto de dados a partir de um bucket S3#

  1. Clica em New Dataset e abre o separador Cloud.
  2. Seleciona um bucket ligado e navega até à pasta que contém os teus dados.
  3. Confirma a pasta, ajusta o nome do dataset e cria o dataset.

A Platform lista a pasta uma vez e indexa o que encontra:

  • Imagens — os objetos .jpg, .jpeg, .png, .webp e .avif são indexados com dimensões lidas através de pedidos limitados. A Platform não guarda uma segunda cópia da imagem de origem.
  • Etiquetas — os ficheiros associados .txt do YOLO são analisados em anotações da Platform, correspondidos pelo esquema padrão images/labels/ ou como elementos irmãos na mesma pasta.
  • Metadados — um ficheiro YAML fornece os nomes das classes e a estrutura dos pontos-chave de pose, exatamente como num carregamento de arquivo. Dá-se preferência a data.yaml e data.yml quando a pasta contém vários ficheiros.
  • Tarefa — uma amostra dos ficheiros de etiquetas determina a tarefa, pelo que as pastas de segmentação, pose e OBB são reconhecidas pela estrutura das respetivas etiquetas, e não pela tarefa escolhida na caixa de diálogo.
  • Divisões — os nomes de pastas train, val e test na chave do objeto atribuem as divisões automaticamente.

O dataset passa então a comportar-se como qualquer outro: explora-o e anota-o, define-o como público ou privado, partilha-o com a tua equipa e treina com ele através do treino gerido. Os originais são transmitidos conforme necessário, e as imagens indexadas não consomem a tua quota de armazenamento da Platform.

Limites

Uma única importação indexa até 50 000 objetos e ficheiros de etiquetas ou YAML com até 1 MB cada. Os buckets maiores devem ser divididos por vários datasets.

Manter os objetos indexados imutáveis

Cada imagem indexada é associada ao ETag do objeto S3, e a Platform bloqueia a operação se um objeto for alterado. Adicione novos objetos em vez de substituir os existentes.

Importações falhadas#

Se uma importação falhar — devido a uma pasta vazia, a um erro no caminho ou a permissões revogadas — o dataset apresenta o erro na sua página. Os editores podem clicar em Retry import para a reiniciar com o bucket e a pasta guardados, ou criar um novo dataset que aponte para o caminho corrigido.

Uma nova tentativa volta a listar a pasta em vez de retomar a operação: os objetos adicionados desde a primeira tentativa são incluídos, e os objetos que já não existem são removidos do dataset.

Treino#

O treinamento gerenciado funciona por meio do fluxo normal de treinamento. O treinamento usa cópias próprias da Platform das imagens associadas durante a execução, e suas credenciais da AWS nunca são expostas às cargas de trabalho de treinamento.

Desligar uma ligação#

A desconexão exclui as credenciais armazenadas sem alterar nada na AWS. Os conjuntos de dados criados a partir desses buckets permanecem no seu espaço de trabalho com suas classes, rótulos e anotações, mas suas imagens não podem ser carregadas, visualizadas ou usadas em treinamentos até que o mesmo usuário IAM seja conectado novamente.

Utiliza a REST API com o ID da integração devolvido por GET /api/integrations/buckets:

curl -X DELETE \
  -H "Authorization: Bearer YOUR_API_KEY" \
  https://platform.ultralytics.com/api/integrations/buckets/INTEGRATION_ID
from ultralytics_platform import Platform

client = Platform()  # reads ULTRALYTICS_API_KEY
integrations = client.storage_integrations.list()
client.storage_integrations.delete("INTEGRATION_ID")

Para revogar o acesso diretamente na origem, desative ou exclua a chave de acesso no AWS IAM.

Limitações atuais#

Os conjuntos de dados vinculados ao S3 atualmente não incluem recursos que exigem cópias das imagens pertencentes à Platform: anotação automática, análise de agrupamento, clonagem de conjuntos de dados e instantâneos de versão imutáveis.

Excluir um conjunto de dados vinculado ao S3, ou imagens individuais dele, remove apenas as referências da Platform — seus objetos nunca são alterados.

Consulte também as integrações com Google Cloud Storage e Azure Blob Storage.

Perguntas frequentes#

  • Não. A Platform lista o bucket uma vez e indexa as dimensões e as etiquetas das imagens que encontra. Os originais são transmitidos em fluxo contínuo a pedido para navegação e anotação, e o treino gerido funciona a partir de cópias próprias da Platform das imagens fixadas apenas durante a duração da execução. As imagens indexadas não contam para a tua quota de armazenamento.

  • Um conjunto de dados é indexado uma vez quando é criado. Os novos objetos não são detetados até criares um novo conjunto de dados ou tentares novamente uma importação falhada, e cada imagem indexada é fixada à respetiva versão, pelo que substituir um objeto faz com que a Platform bloqueie nessa imagem. Adiciona novos objetos em vez de substituíres os existentes.

  • As funcionalidades que necessitam de cópias de imagens pertencentes à Platform são excluídas nos conjuntos de dados ligados: anotação automática, análise de agrupamento, clonagem de conjuntos de dados e instantâneos de versão imutáveis. A anotação manual, a partilha e o treino funcionam normalmente.

  • Desconecta a integração em Settings > Integrations para excluir as credenciais armazenadas, ou desativa ou exclui a chave de acesso no IAM da AWS. Nenhuma das duas ações mexe nos dados dos teus buckets.

Contribuidores

Comentários