Integração com Amazon S3#
A integração com Amazon S3 conecta os teus buckets do S3 à Ultralytics Platform. As tuas imagens permanecem nos teus buckets — a Platform indexa-as no local, para que possas navegar, anotá-las e treinar modelos YOLO sem carregar uma cópia.
Os conjuntos de dados do Amazon S3 requerem um plano Pro ou Enterprise. Os espaços de trabalho gratuitos veem a integração e recebem uma mensagem para fazer o upgrade ao conectar. Os conjuntos de dados existentes do Amazon S3 continuam totalmente acessíveis se uma subscrição terminar — só as novas conexões e importações requerem o Pro.
Criar um utilizador IAM só de leitura#
A Platform apenas lê o teu armazenamento — nunca grava, modifica nem elimina os teus objetos. Usa um utilizador IAM dedicado com apenas permissões de listagem e leitura — nunca uses credenciais root:
-
Na consola da AWS, acede a IAM > Users e cria um utilizador sem acesso à consola.
-
Anexa uma política que conceda apenas permissões de listagem e leitura aos buckets que pretendes conectar:
{ "Version": "2012-10-17", "Statement": [ { "Effect": "Allow", "Action": "s3:ListAllMyBuckets", "Resource": "*" }, { "Effect": "Allow", "Action": ["s3:ListBucket", "s3:GetObject"], "Resource": ["arn:aws:s3:::my-bucket", "arn:aws:s3:::my-bucket/*"] } ] }s3:ListAllMyBucketsé opcional — permite que a Platform descubra os teus buckets, para que não tenhas de escrever os nomes. -
Abre o separador Security credentials do utilizador, cria uma access key e copia o ID da chave de acesso e a chave de acesso secreta.
A Platform rejeita credenciais temporárias da AWS. As chaves emitidas pelo AWS STS — incluindo qualquer chave que comece com ASIA, credenciais de sessão de função
e chaves do IAM Identity Center — expiram enquanto um conjunto de dados ainda está conectado, pelo que é necessária uma chave de acesso de longa duração de um
utilizador IAM dedicado.
Conectar à Platform#
- Acede a Settings > Integrations e seleciona Amazon S3 na lista de integrações.
- Introduz o ID da chave de acesso, a chave de acesso secreta e a região do bucket (por exemplo,
us-east-1). - Clica em Find available buckets e seleciona os buckets a conectar. Se a política não permitir a descoberta, introduz manualmente o nome de um bucket conhecido.
- Clica em Connect. A Platform verifica se consegue listar e ler cada bucket selecionado antes de guardar qualquer informação.

Precisas da função de administrador ou proprietário do espaço de trabalho para conectar o armazenamento na nuvem. Uma conexão suporta até 50 buckets e a descoberta lista até 300 dos buckets a que a chave tem acesso.
Voltar a conectar o mesmo utilizador IAM mais tarde adiciona novos buckets à integração existente. Uma credencial guardada só é substituída quando a credencial de substituição ainda consegue ler todos os buckets que já conectaste.
Uma conexão lê os buckets na região que introduzires. Se os teus buckets estiverem em várias regiões, cria uma conexão por região.
As credenciais são encriptadas em repouso com AES-256-GCM, nunca são devolvidas ao navegador e nunca são expostas às cargas de trabalho de treino. Para revogar o acesso, desativa a chave de acesso no AWS IAM.
Criar um conjunto de dados a partir de um bucket S3#
- Clica em New Dataset e abre o separador Cloud.
- Escolhe um bucket conectado e navega até à pasta que contém os teus dados.
- Confirma a pasta, ajusta o nome do conjunto de dados e cria-o.
A Platform lista a pasta uma vez e cria um índice do que encontra:
- Imagens — os objetos
.jpg,.jpeg,.png,.webpe.avifsão indexados com dimensões lidas através de pedidos limitados. A Platform não guarda uma segunda cópia da imagem de origem. - Rótulos — os ficheiros auxiliares
.txtdo YOLO são analisados e convertidos em anotações na Platform, correspondendo ao esquema padrãoimages/→labels/ou a ficheiros na mesma pasta. - Metadados — um ficheiro YAML fornece os nomes das classes e a estrutura dos pontos-chave de pose, tal como num carregamento de arquivo. Dá-se preferência a
data.yamledata.ymlquando a pasta contém vários ficheiros. - Tarefa — uma amostra dos ficheiros de rótulos determina a tarefa, por isso as pastas de segmentação, pose e OBB são reconhecidas pela estrutura dos respetivos rótulos, e não pela tarefa escolhida na caixa de diálogo.
- Divisões — os nomes de pastas
train,valetestna chave do objeto atribuem automaticamente as divisões.
A partir daí, o conjunto de dados funciona como qualquer outro: navega e anota, define-o como público ou privado, partilha-o com a tua equipa e treina com ele através do treino gerido. Os originais são transmitidos a pedido, e as imagens indexadas não consomem a tua quota de armazenamento da Platform.
Uma única importação indexa até 500.000 objetos e ficheiros de rótulos ou YAML até 1 MB cada. Os buckets maiores devem ser divididos por vários conjuntos de dados.
Cada imagem indexada fica associada ao ETag do respetivo objeto S3, e a Platform falha de forma segura se um objeto for alterado. Adiciona novos objetos em vez de substituir os existentes.
Importações falhadas#
Se uma importação falhar — por uma pasta vazia, um erro de digitação no caminho ou permissões revogadas — o conjunto de dados apresenta o erro na respetiva página. Os editores podem clicar em Retry import para reiniciar a importação com o bucket e a pasta guardados, ou criar um novo conjunto de dados com o caminho corrigido.
Uma nova tentativa volta a listar a pasta em vez de continuar de onde ficou: os objetos adicionados desde a primeira tentativa são incluídos, e os objetos que já não estão lá são removidos do conjunto de dados.
Treino#
O treino gerido funciona através do fluxo de treino normal. Durante a execução, o treino usa as próprias cópias da Platform das imagens associadas, e as tuas credenciais da AWS nunca são expostas às cargas de trabalho de treino.
Desconectar uma conexão#
Desconectar elimina as credenciais armazenadas sem alterar nada na AWS. Os conjuntos de dados criados a partir desses buckets permanecem no teu espaço de trabalho com as respetivas classes, etiquetas e anotações, mas não é possível carregar, pré-visualizar nem treinar com as imagens até voltares a conectar o mesmo utilizador IAM.
Usa a REST API com o ID da integração devolvido por GET /api/integrations/buckets:
curl -X DELETE \
-H "Authorization: Bearer YOUR_API_KEY" \
https://platform.ultralytics.com/api/integrations/buckets/INTEGRATION_IDfrom ultralytics_platform import Platform
client = Platform() # reads ULTRALYTICS_API_KEY
integrations = client.storage_integrations.list()
client.storage_integrations.delete("INTEGRATION_ID")Para revogar o acesso na origem, desativa ou elimina a chave de acesso no AWS IAM.
Limitações atuais#
Os conjuntos de dados baseados no S3 não incluem atualmente funcionalidades que requerem cópias das imagens geridas pela Platform: anotação automática, análise de agrupamento, clonagem de conjuntos de dados e instantâneos de versões imutáveis.
Eliminar um conjunto de dados baseado no S3, ou imagens individuais desse conjunto, remove apenas as referências da Platform — os teus objetos nunca são alterados.
Consulta também as integrações com Google Cloud Storage e Azure Blob Storage.
Perguntas frequentes#
Não. A Platform lista o bucket uma vez e cria um índice das dimensões das imagens e dos rótulos que encontra. Os originais são transmitidos a pedido para navegação e anotação, e o treino gerido utiliza as cópias das imagens fixadas que pertencem à Platform apenas durante a execução. As imagens indexadas não contam para a tua quota de armazenamento.
Um conjunto de dados é indexado uma única vez, quando é criado. Os novos objetos não são incluídos até criares um novo conjunto de dados ou voltares a tentar uma importação falhada, e cada imagem indexada fica associada à respetiva versão; por isso, se substituíres um objeto, a Platform falha em modo fechado nessa imagem. Adiciona novos objetos em vez de substituir os existentes.
As funcionalidades que precisam de cópias das imagens pertencentes à Platform não estão disponíveis em conjuntos de dados conectados: anotação automática, análise de agrupamento, clonagem de conjuntos de dados e instantâneos de versões imutáveis. A anotação manual, a partilha e o treino funcionam normalmente.
Desconecta a integração em Settings > Integrations para eliminar as credenciais armazenadas, ou desativa ou elimina a chave de acesso no AWS IAM. Nenhuma das ações altera os dados nos teus buckets.