Integração com Amazon S3#
A integração com o Amazon S3 conecta seus buckets do S3 à Ultralytics Platform. Suas imagens permanecem nos seus buckets — a Platform as indexa no local, para que você possa navegar, anotar e treinar modelos YOLO sem enviar uma cópia.
Os conjuntos de dados do Amazon S3 exigem um plano Pro ou Enterprise. Os espaços de trabalho gratuitos veem a integração e são solicitados a fazer upgrade ao conectar. Os conjuntos de dados existentes do Amazon S3 permanecem totalmente acessíveis se uma assinatura terminar — apenas novas conexões e importações exigem o plano Pro.
Criar um usuário IAM somente leitura#
A Platform apenas lê seu armazenamento — ela nunca grava, modifica ou exclui seus objetos. Use um usuário IAM dedicado com acesso somente para listar e ler — nunca use credenciais root:
-
No console da AWS, acesse IAM > Users e crie um usuário sem acesso ao console.
-
Anexe uma política que conceda apenas acesso para listar e ler os buckets que você deseja conectar:
{ "Version": "2012-10-17", "Statement": [ { "Effect": "Allow", "Action": "s3:ListAllMyBuckets", "Resource": "*" }, { "Effect": "Allow", "Action": ["s3:ListBucket", "s3:GetObject"], "Resource": ["arn:aws:s3:::my-bucket", "arn:aws:s3:::my-bucket/*"] } ] }s3:ListAllMyBucketsé opcional — ele permite que a Platform descubra seus buckets, para que você não precise digitar os nomes. -
Abra a aba Security credentials do usuário, crie uma access key e copie o ID da chave de acesso e a chave de acesso secreta.
A Platform rejeita credenciais temporárias da AWS. As chaves emitidas pelo AWS STS — incluindo qualquer chave que comece com ASIA, credenciais de
sessão de função e chaves do IAM Identity Center — expiram enquanto um conjunto de dados ainda está conectado, portanto é necessária a chave de acesso de longa duração de um
usuário IAM dedicado.
Ligar à Platform#
- Acesse Settings > Integrations e selecione Amazon S3 na lista de integrações.
- Insira o ID da chave de acesso, a chave de acesso secreta e a região do bucket (por exemplo,
us-east-1). - Clique em Find available buckets e selecione os buckets a conectar. Se a política não permitir a descoberta, insira manualmente o nome de um bucket conhecido.
- Clica em Connect. A Platform verifica se consegue listar e ler cada bucket selecionado antes de guardar qualquer informação.

Você precisa da função de administrador ou proprietário do espaço de trabalho para conectar o armazenamento em nuvem. Uma conexão comporta até 50 buckets, e a descoberta lista até 300 dos buckets que a chave pode acessar.
Conectar o mesmo usuário IAM novamente mais tarde adiciona novos buckets à integração existente. Uma credencial salva só é substituída quando a credencial substituta ainda consegue ler todos os buckets que você já conectou.
Uma conexão lê os buckets na região que você inserir. Se seus buckets estiverem em várias regiões, conecte-se uma vez por região.
As credenciais são criptografadas em repouso com AES-256-GCM, nunca são retornadas ao navegador e nunca são expostas às cargas de trabalho de treinamento. Para revogar o acesso, desative a chave de acesso no AWS IAM.
Criar um conjunto de dados a partir de um bucket S3#
- Clica em New Dataset e abre o separador Cloud.
- Seleciona um bucket ligado e navega até à pasta que contém os teus dados.
- Confirma a pasta, ajusta o nome do dataset e cria o dataset.
A Platform lista a pasta uma vez e indexa o que encontra:
- Imagens — os objetos
.jpg,.jpeg,.png,.webpe.avifsão indexados com dimensões lidas através de pedidos limitados. A Platform não guarda uma segunda cópia da imagem de origem. - Etiquetas — os ficheiros associados
.txtdo YOLO são analisados em anotações da Platform, correspondidos pelo esquema padrãoimages/→labels/ou como elementos irmãos na mesma pasta. - Metadados — um ficheiro YAML fornece os nomes das classes e a estrutura dos pontos-chave de pose, exatamente como num carregamento de arquivo. Dá-se preferência a
data.yamledata.ymlquando a pasta contém vários ficheiros. - Tarefa — uma amostra dos ficheiros de etiquetas determina a tarefa, pelo que as pastas de segmentação, pose e OBB são reconhecidas pela estrutura das respetivas etiquetas, e não pela tarefa escolhida na caixa de diálogo.
- Divisões — os nomes de pastas
train,valetestna chave do objeto atribuem as divisões automaticamente.
O dataset passa então a comportar-se como qualquer outro: explora-o e anota-o, define-o como público ou privado, partilha-o com a tua equipa e treina com ele através do treino gerido. Os originais são transmitidos conforme necessário, e as imagens indexadas não consomem a tua quota de armazenamento da Platform.
Uma única importação indexa até 50 000 objetos e ficheiros de etiquetas ou YAML com até 1 MB cada. Os buckets maiores devem ser divididos por vários datasets.
Cada imagem indexada é associada ao ETag do objeto S3, e a Platform bloqueia a operação se um objeto for alterado. Adicione novos objetos em vez de substituir os existentes.
Importações falhadas#
Se uma importação falhar — devido a uma pasta vazia, a um erro no caminho ou a permissões revogadas — o dataset apresenta o erro na sua página. Os editores podem clicar em Retry import para a reiniciar com o bucket e a pasta guardados, ou criar um novo dataset que aponte para o caminho corrigido.
Uma nova tentativa volta a listar a pasta em vez de retomar a operação: os objetos adicionados desde a primeira tentativa são incluídos, e os objetos que já não existem são removidos do dataset.
Treino#
O treinamento gerenciado funciona por meio do fluxo normal de treinamento. O treinamento usa cópias próprias da Platform das imagens associadas durante a execução, e suas credenciais da AWS nunca são expostas às cargas de trabalho de treinamento.
Desligar uma ligação#
A desconexão exclui as credenciais armazenadas sem alterar nada na AWS. Os conjuntos de dados criados a partir desses buckets permanecem no seu espaço de trabalho com suas classes, rótulos e anotações, mas suas imagens não podem ser carregadas, visualizadas ou usadas em treinamentos até que o mesmo usuário IAM seja conectado novamente.
Utiliza a REST API com o ID da integração devolvido por GET /api/integrations/buckets:
curl -X DELETE \
-H "Authorization: Bearer YOUR_API_KEY" \
https://platform.ultralytics.com/api/integrations/buckets/INTEGRATION_IDfrom ultralytics_platform import Platform
client = Platform() # reads ULTRALYTICS_API_KEY
integrations = client.storage_integrations.list()
client.storage_integrations.delete("INTEGRATION_ID")Para revogar o acesso diretamente na origem, desative ou exclua a chave de acesso no AWS IAM.
Limitações atuais#
Os conjuntos de dados vinculados ao S3 atualmente não incluem recursos que exigem cópias das imagens pertencentes à Platform: anotação automática, análise de agrupamento, clonagem de conjuntos de dados e instantâneos de versão imutáveis.
Excluir um conjunto de dados vinculado ao S3, ou imagens individuais dele, remove apenas as referências da Platform — seus objetos nunca são alterados.
Consulte também as integrações com Google Cloud Storage e Azure Blob Storage.
Perguntas frequentes#
Não. A Platform lista o bucket uma vez e indexa as dimensões e as etiquetas das imagens que encontra. Os originais são transmitidos em fluxo contínuo a pedido para navegação e anotação, e o treino gerido funciona a partir de cópias próprias da Platform das imagens fixadas apenas durante a duração da execução. As imagens indexadas não contam para a tua quota de armazenamento.
Um conjunto de dados é indexado uma vez quando é criado. Os novos objetos não são detetados até criares um novo conjunto de dados ou tentares novamente uma importação falhada, e cada imagem indexada é fixada à respetiva versão, pelo que substituir um objeto faz com que a Platform bloqueie nessa imagem. Adiciona novos objetos em vez de substituíres os existentes.
As funcionalidades que necessitam de cópias de imagens pertencentes à Platform são excluídas nos conjuntos de dados ligados: anotação automática, análise de agrupamento, clonagem de conjuntos de dados e instantâneos de versão imutáveis. A anotação manual, a partilha e o treino funcionam normalmente.
Desconecta a integração em Settings > Integrations para excluir as credenciais armazenadas, ou desativa ou exclui a chave de acesso no IAM da AWS. Nenhuma das duas ações mexe nos dados dos teus buckets.