Integrazione Amazon S3#
L'integrazione Amazon S3 collega i tuoi bucket S3 a Ultralytics Platform. Le tue immagini rimangono nei tuoi bucket: Platform le indicizza sul posto, così puoi esplorarle, annotarle e addestrare modelli YOLO senza caricarne una copia.
I dataset Amazon S3 richiedono un piano Pro o Enterprise. Negli spazi di lavoro gratuiti l'integrazione è visibile e viene richiesto di effettuare l'upgrade quando si prova a connettersi. I dataset Amazon S3 esistenti rimangono completamente accessibili se un abbonamento termina: solo le nuove connessioni e le nuove importazioni richiedono Pro.
Crea un utente IAM di sola lettura#
Platform legge soltanto dal tuo spazio di archiviazione: non scrive, modifica né elimina mai i tuoi oggetti. Usa un utente IAM dedicato con accesso limitato all'elenco e alla lettura, mai le credenziali root:
-
Nella console AWS, vai a IAM > Users e crea un utente senza accesso alla console.
-
Associa una policy che conceda solo l'accesso all'elenco e alla lettura per i bucket che vuoi collegare:
{ "Version": "2012-10-17", "Statement": [ { "Effect": "Allow", "Action": "s3:ListAllMyBuckets", "Resource": "*" }, { "Effect": "Allow", "Action": ["s3:ListBucket", "s3:GetObject"], "Resource": ["arn:aws:s3:::my-bucket", "arn:aws:s3:::my-bucket/*"] } ] }s3:ListAllMyBucketsè facoltativo: consente a Platform di individuare i tuoi bucket, così non devi inserirne i nomi. -
Apri la scheda Security credentials dell'utente, crea una chiave di accesso e copia l'ID della chiave di accesso e la chiave di accesso segreta.
Platform rifiuta le credenziali AWS temporanee. Le chiavi rilasciate da AWS STS, comprese quelle che iniziano con ASIA, le credenziali di sessione dei ruoli e le chiavi di IAM Identity Center, scadono mentre un dataset è ancora connesso; è quindi necessaria una chiave di accesso di lunga durata appartenente a un utente IAM dedicato.
Collegati a Platform#
- Vai a Settings > Integrations e seleziona Amazon S3 dall'elenco delle integrazioni.
- Inserisci l'ID della chiave di accesso, la chiave di accesso segreta e la regione del bucket (ad esempio
us-east-1). - Fai clic su Find available buckets, quindi seleziona i bucket da collegare. Se la policy non consente l'individuazione, inserisci manualmente il nome di un bucket noto.
- Fai clic su Connect. Prima di salvare, Platform verifica di poter elencare e leggere ogni bucket selezionato.

Per collegare l'archiviazione cloud, devi avere il ruolo di amministratore o proprietario dello spazio di lavoro. Una connessione può includere fino a 50 bucket e l'individuazione mostra fino a 300 dei bucket accessibili con la chiave.
Se in seguito ti riconnetti con lo stesso utente IAM, i nuovi bucket vengono aggiunti all'integrazione esistente. Una credenziale salvata viene sostituita solo se la credenziale sostitutiva può continuare a leggere tutti i bucket già collegati.
Una connessione legge i bucket nella regione che inserisci. Se i tuoi bucket si trovano in più regioni, effettua una connessione per ogni regione.
Le credenziali sono crittografate a riposo con AES-256-GCM, non vengono mai restituite al browser e non vengono mai esposte ai carichi di lavoro di addestramento. Per revocare l'accesso, disattiva la chiave di accesso in AWS IAM.
Crea un dataset da un bucket S3#
- Fai clic su New Dataset e apri la scheda Cloud.
- Scegli un bucket collegato e individua la cartella che contiene i tuoi dati.
- Conferma la cartella, modifica il nome del dataset e crealo.
Platform elenca una sola volta il contenuto della cartella e indicizza ciò che trova:
- Immagini — gli oggetti
.jpg,.jpeg,.png,.webpe.avifvengono indicizzati con le dimensioni lette tramite richieste con limiti definiti. Platform non salva una seconda copia dell'immagine sorgente. - Etichette — i file accessori
.txtYOLO vengono analizzati e convertiti in annotazioni Platform, associate tramite la struttura standardimages/→labels/o come file nella stessa cartella. - Metadati — un file YAML fornisce i nomi delle classi e la struttura dei punti chiave per la posa, proprio come un caricamento di archivio. Se nella cartella ce ne sono diversi, vengono preferiti
data.yamledata.yml. - Attività — l'attività viene determinata esaminando un campione dei file di etichetta, quindi le cartelle di segmentazione, posa e OBB vengono riconosciute dalla struttura delle etichette, non dall'attività selezionata nella finestra di dialogo.
- Suddivisioni — I nomi delle cartelle
train,valetestnella chiave dell'oggetto assegnano automaticamente le suddivisioni.
Il dataset si comporta quindi come qualsiasi altro: puoi sfogliarlo e annotarlo, renderlo pubblico o privato, condividerlo con il tuo team e addestrare modelli tramite l'addestramento gestito. Gli originali vengono trasmessi su richiesta e le immagini indicizzate non consumano la tua quota di archiviazione Platform.
Una singola importazione indicizza fino a 500.000 oggetti e file di etichette o YAML fino a 1 MB ciascuno. I bucket più grandi andrebbero suddivisi in più dataset.
Ogni immagine indicizzata è associata all'ETag del relativo oggetto S3 e Platform interrompe l'operazione per sicurezza se l'oggetto viene modificato. Aggiungi nuovi oggetti anziché sovrascrivere quelli esistenti.
Importazioni non riuscite#
Se un'importazione non riesce — perché la cartella è vuota, il percorso contiene un errore di battitura o le autorizzazioni sono state revocate — il dataset mostra l'errore nella sua pagina. Gli editor possono fare clic su Retry import per riavviare l'importazione usando il bucket e la cartella salvati, oppure creare un nuovo dataset che punta al percorso corretto.
Un nuovo tentativo elenca di nuovo la cartella anziché riprendere l'importazione: vengono acquisiti gli oggetti aggiunti dopo il primo tentativo e rimossi dal dataset quelli che non sono più presenti.
Addestramento#
L'addestramento gestito funziona tramite il normale flusso di addestramento. Per tutta la durata dell'esecuzione, l'addestramento usa le copie delle immagini associate create da Platform e le tue credenziali AWS non vengono mai esposte ai carichi di lavoro di addestramento.
Disconnetti una connessione#
La disconnessione elimina le credenziali memorizzate senza modificare nulla in AWS. I dataset creati a partire da quei bucket rimangono nel tuo spazio di lavoro con le relative classi, etichette e annotazioni, ma le immagini non possono essere caricate, visualizzate in anteprima o usate per l'addestramento finché non viene riconnesso lo stesso utente IAM.
Usa la REST API con l'ID dell'integrazione restituito da GET /api/integrations/buckets:
curl -X DELETE \
-H "Authorization: Bearer YOUR_API_KEY" \
https://platform.ultralytics.com/api/integrations/buckets/INTEGRATION_IDfrom ultralytics_platform import Platform
client = Platform() # reads ULTRALYTICS_API_KEY
integrations = client.storage_integrations.list()
client.storage_integrations.delete("INTEGRATION_ID")Per revocare l'accesso direttamente all'origine, disattiva o elimina la chiave di accesso in AWS IAM.
Limitazioni attuali#
I dataset basati su S3 attualmente non supportano le funzionalità che richiedono copie delle immagini gestite da Platform: annotazione automatica, analisi del clustering, clonazione dei dataset e istantanee di versione immutabili.
L'eliminazione di un dataset basato su S3, o di singole immagini al suo interno, rimuove solo i riferimenti di Platform: i tuoi oggetti non vengono mai modificati.
Consulta anche le integrazioni Google Cloud Storage e Azure Blob Storage.
Domande frequenti#
No. Platform elenca il bucket una sola volta e indicizza le dimensioni delle immagini e le etichette che trova. Gli originali vengono trasmessi su richiesta per la consultazione e l'annotazione; per tutta la durata dell'esecuzione, l'addestramento gestito usa esclusivamente copie proprie di Platform delle immagini associate alle rispettive versioni. Le immagini indicizzate non vengono conteggiate nella tua quota di archiviazione.
Un dataset viene indicizzato una sola volta, al momento della creazione. I nuovi oggetti non vengono acquisiti finché non crei un nuovo dataset o riprovi un'importazione non riuscita; inoltre, ogni immagine indicizzata è associata alla propria versione, quindi se sovrascrivi un oggetto Platform si blocca in modo sicuro per quell'immagine. Aggiungi nuovi oggetti anziché sostituire quelli esistenti.
Nei dataset collegati non sono disponibili le funzionalità che richiedono copie delle immagini gestite da Platform: annotazione automatica, analisi dei cluster, clonazione dei dataset e istantanee di versione immutabili. L'annotazione manuale, la condivisione e l'addestramento funzionano normalmente.
Disconnetti l'integrazione in Settings > Integrations per eliminare le credenziali memorizzate, oppure disattiva o elimina la chiave di accesso in AWS IAM. Nessuna delle due azioni modifica i dati nei tuoi bucket.