Endpoint dedicati#
Ultralytics Platform ti consente di distribuire modelli YOLO su endpoint dedicati in 42 regioni globali. Ogni endpoint è un servizio single-tenant con comportamento scale-to-zero, un URL di endpoint univoco e monitoraggio indipendente.

Crea Endpoint#
Dalla scheda Deploy#
Distribuisci un modello dalla sua scheda Deploy:
- Naviga verso il tuo modello
- Fai clic sulla scheda Deploy
- Esamina la mappa del mondo e la tabella delle regioni, ordinate in base alla latenza misurata dalla tua posizione
- Clicca su Deploy nella riga della regione che vuoi usare
Il nome della distribuzione viene generato automaticamente dal nome del modello e dalla città della regione (ad esempio, yolo26n-iowa).
Dalla pagina Deployments#
Crea una distribuzione dalla pagina globale Deploy nella barra laterale:
- Fai clic su New Deployment
- Seleziona un modello dal selettore di modelli
- Seleziona una regione dalla mappa o dalla tabella
- Esamina il nome del deployment generato automaticamente e modificabile e le risorse predefinite fisse
- Fai clic su Deploy Model

Ciclo di vita della distribuzione#
stateDiagram-v2
[*] --> Creating: Deploy
Creating --> Deploying: Container starting
Deploying --> Ready: Health check passed
Ready --> Stopping: Stop
Stopping --> Stopped: Stopped
Stopped --> Ready: Start
Ready --> [*]: Delete
Stopped --> [*]: Delete
Creating --> Failed: Error
Deploying --> Failed: Error
Failed --> [*]: Delete
classDef proc fill:#2196F3,color:#fff
classDef out fill:#9C27B0,color:#fff
classDef error fill:#F44336,color:#fff
classDef extern fill:#607D8B,color:#fff
class Creating,Deploying,Stopping proc
class Ready out
class Failed error
class Stopped externConnetti gli avvisi Slack per ricevere un messaggio quando una distribuzione è pronta o non riesce ad avviarsi.
Selezione Regione#
Scegli tra 42 regioni in tutto il mondo. La mappa interattiva delle regioni e la tabella mostrano:
- Pin delle regioni: codificati a colori per latenza su un gradiente da verde a rosso (le regioni più veloci sono più verdi, quelle più lente sono più rosse)
- Regioni distribuite: evidenziate con un badge "Deployed"
- Regioni in fase di distribuzione: indicatore pulsante animato
- Evidenziazione bidirezionale: passando il mouse sulla mappa viene evidenziata la riga della tabella e viceversa
La tabella delle regioni nella scheda Deploy del modello include:
| Colonna | Descrizione |
|---|---|
| Location | Città e paese con icona della bandiera |
| Zone | Identificatore della regione |
| Latenza | Tempo di ping misurato (mediana di 3 ping) |
| Distance | Distanza dalla tua posizione in km |
| Actions | Pulsante Deploy o badge di stato "Deployed" |
La finestra di dialogo New Deployment (dalla pagina Deploy globale) mostra una tabella delle regioni più semplice con sole colonne Location, Latency e Select.
Seleziona la regione più vicina ai tuoi utenti per la latenza più bassa. Usa il pulsante Rescan per misurare nuovamente la latenza dalla tua posizione attuale.
Regioni disponibili#
| Zone | Posizione |
|---|---|
| us-central1 | Iowa, USA |
| us-east1 | Carolina del Sud, USA |
| us-east4 | Virginia settentrionale, USA |
| us-east5 | Columbus, USA |
| us-south1 | Dallas, USA |
| us-west1 | Oregon, USA |
| us-west2 | Los Angeles, USA |
| us-west3 | Salt Lake City, USA |
| us-west4 | Las Vegas, USA |
| northamerica-northeast1 | Montreal, Canada |
| northamerica-northeast2 | Toronto, Canada |
| northamerica-south1 | Queretaro, Messico |
| southamerica-east1 | San Paolo, Brasile |
| southamerica-west1 | Santiago, Cile |
Configurazione endpoint#
Finestra di dialogo New Deployment#
La finestra di dialogo New Deployment fornisce:
| Impostazione | Descrizione | Predefinito |
|---|---|---|
| Modello | Seleziona tra i modelli completati | - |
| Regione | Regione del deployment | - |
| Nome distribuzione | Generato automaticamente, modificabile | - |
| Core CPU | Predefinito fisso | 1 |
| Memoria (GB) | Predefinito fisso | 2 |
Il pannello Resources disattivato è contrassegnato come Coming Soon e al momento non può essere espanso o personalizzato. I deployment usano 1 CPU, 2 GiB di memoria, minInstances = 0 e maxInstances = 1.
Il nome della distribuzione viene generato automaticamente dal nome del modello e dalla città della regione (ad esempio, yolo26n-iowa). Se distribuisci nuovamente lo stesso modello nella stessa regione, verrà aggiunto un suffisso numerico (ad esempio, yolo26n-iowa-2).
Scheda Distribuisci (Distribuzione rapida)#
Quando effettui la distribuzione dalla scheda Deploy del modello, gli endpoint vengono creati con risorse predefinite (1 CPU, 2 GB di memoria) con il ridimensionamento a zero abilitato. Il nome della distribuzione viene generato automaticamente.
Gestisci endpoint#
Modalità di visualizzazione#
L'elenco delle distribuzioni supporta tre modalità di visualizzazione:
| Modalità | Descrizione |
|---|---|
| Schede | Schede con dettagli completi comprensive di log, esempi di codice e pannello di predizione |
| Compatta | Griglia di schede più piccole con metriche chiave |
| Tabella | DataTable con colonne ordinabili e ricerca |

Scheda distribuzione (Vista schede)#
Ogni scheda di distribuzione nella vista a schede mostra:
- Intestazione: Nome, bandiera della regione, badge di stato, pulsanti di avvio/arresto/eliminazione
- URL endpoint: URL copiabile con link alla documentazione dell'API
- Metriche: Conteggio richieste (24 ore), latenza P95, tasso di errore
- Controllo integrità: Indicatore di stato live con latenza e aggiornamento manuale
- Schede:
Logs,CodeePredict
La scheda Logs mostra le voci di log recenti con filtro di gravità (Tutti / Errori). La scheda Code mostra esempi di codice pronti all'uso in Python, JavaScript e cURL con il tuo URL dell'endpoint effettivo e la chiave API. La scheda Predict fornisce un pannello di predizione integrato per i test direttamente sulla distribuzione.
Stati della distribuzione#
| Stato | Descrizione |
|---|---|
| Creazione in corso | La distribuzione è in fase di configurazione |
| Distribuzione in corso | Il container è in fase di avvio |
| Pronto | L'endpoint è attivo e accetta richieste |
| Arresto in corso | L'endpoint si sta chiudendo |
| Arrestato | L'endpoint è in pausa e non disponibile |
| Failed | Distribuzione non riuscita (vedi messaggio di errore) |
URL endpoint#
Ogni endpoint ha un URL univoco, ad esempio:
https://predict-abc123.run.app
Clicca sul pulsante di copia per copiare l'URL. Clicca sull'icona della documentazione per visualizzare la documentazione API generata automaticamente per l'endpoint.
Gestione del ciclo di vita#
Controlla lo stato del tuo endpoint:
graph LR
R[Ready]:::out -->|Stop| S[Stopped]:::extern
S -->|Start| R
R -->|Delete| D[Deleted]:::error
S -->|Delete| D
classDef out fill:#9C27B0,color:#fff
classDef error fill:#F44336,color:#fff
classDef extern fill:#607D8B,color:#fff| Azione | Descrizione |
|---|---|
| Avvia | Riprendi un endpoint arrestato |
| Arresta | Metti in pausa l'endpoint |
| Elimina | Rimuovi permanentemente l'endpoint |
Arresta endpoint#
Arresta un endpoint quando non vuoi che accetti richieste:
- Fai clic sull'icona di pausa sulla scheda di distribuzione
- Lo stato dell'endpoint cambia in "Arresto in corso" e poi in "Arrestato"
Endpoint arrestati:
- Non accettano richieste
- Possono essere riavviati in qualsiasi momento
Elimina endpoint#
Rimuovi permanentemente un endpoint:
- Fai clic sull'icona di eliminazione (cestino) sulla scheda di distribuzione
- Conferma l'eliminazione nella finestra di dialogo
L'eliminazione è immediata e permanente. Puoi sempre creare un nuovo endpoint.
Utilizzo degli endpoint#
Autenticazione#
Ogni distribuzione viene creata con una chiave API dal tuo account. Includila nelle richieste:
Authorization: Bearer YOUR_API_KEYIl prefisso della chiave API viene visualizzato nel piè di pagina della scheda di distribuzione per l'identificazione. Genera le chiavi da API Keys.
Richieste dirette all'endpoint#
Invia le richieste di produzione direttamente all'URL mostrato sulla scheda del deployment. Queste richieste non passano attraverso il limitatore di velocità delle API di Platform. L'endpoint attualmente esegue un'istanza con le risorse fisse descritte sopra.
Esempio di richiesta#
import requests
# Deployment endpoint
url = "https://predict-abc123.run.app/predict"
# Headers with your deployment API key
headers = {"Authorization": "Bearer YOUR_API_KEY"}
# Inference parameters
data = {"conf": 0.25, "iou": 0.7, "imgsz": 640}
# Send image for inference
with open("image.jpg", "rb") as f:
response = requests.post(url, headers=headers, data=data, files={"file": f})
print(response.json())Parametri della richiesta#
| Parametro | Tipo | Predefinito | Intervallo | Descrizione |
|---|---|---|---|---|
file | file | - | - | File immagine o video (obbligatorio a meno che non sia impostato source) |
conf | float | 0.25 | 0,01 – 1,0 | Soglia minima di confidenza |
iou | float | 0.7 | 0,0 – 0,95 | Soglia IoU per NMS |
imgsz | int | 640 | 32 – 1280 | Dimensione dell'immagine in input in pixel |
normalize | bool | false | - | Restituisci le coordinate del BBox come 0 – 1 |
decimals | int | 5 | 0 – 10 | Precisione decimale per i valori delle coordinate |
source | stringa | - | - | URL dell'immagine o stringa base64 (alternativa a file) |
Gli endpoint dedicati accettano sia immagini che video tramite il parametro file.
- Formati immagine (fino a 100 MB): AVIF, BMP, DNG, HEIC, JP2, JPEG, JPG, MPO, PNG, TIF, TIFF, WEBP
- Formati video (fino a 100 MB): ASF, AVI, GIF, M4V, MKV, MOV, MP4, MPEG, MPG, TS, WEBM, WMV
Ogni fotogramma del video viene elaborato individualmente e i risultati vengono restituiti per ogni fotogramma. Puoi anche passare un URL pubblico dell'immagine o un'immagine codificata in base64 tramite il parametro source al posto di file.
Formato risposta#
Uguale all'inferenza condivisa con campi specifici per il task.
FAQ#
Quanti endpoint posso creare?#
I limiti degli endpoint dipendono dal piano:
- Free: Fino a 3 deployment
- Pro: Fino a 10 deployment
- Enterprise: Deployment illimitati
Ogni modello può comunque essere distribuito in più regioni entro la quota del tuo piano.
Posso cambiare regione dopo il deployment?#
No, le regioni sono fisse. Per cambiare regione:
- Elimina l'endpoint esistente
- Crea un nuovo endpoint nella regione desiderata
Come gestisco il deployment multi-regione?#
Per una copertura globale:
- Esegui il deployment in più regioni
- Usa un bilanciatore di carico o il routing DNS
- Indirizza gli utenti verso l'endpoint più vicino
Qual è il tempo di cold start?#
Il tempo di cold start dipende dal modello e dal fatto che l'endpoint sia sceso a zero istanze. La richiesta di controllo dello stato di Platform consente fino a 55 secondi affinché un endpoint inattivo abbia il tempo di avviarsi.
Ogni deployment attualmente utilizza l'URL dell'endpoint generato mostrato sulla sua scheda di deployment.