Monitoraggio#
Ultralytics Platform offre il monitoraggio per gli endpoint distribuiti. Traccia le metriche delle richieste, visualizza i log e controlla lo stato di salute con il polling automatico.

Dashboard delle distribuzioni#
La pagina Deploy nella barra laterale funge da dashboard di monitoraggio per tutte le tue distribuzioni. Combina la mappa del mondo, le metriche panoramica e la gestione delle distribuzioni in un'unica vista. Consulta Endpoint dedicati per la creazione e la gestione delle distribuzioni.
graph TB
subgraph Dashboard
Map[World Map]:::proc --- Cards[Overview Cards]:::proc
Cards --- List[Deployments List]:::decide
end
subgraph "Per Deployment"
Metrics[Metrics Row]:::out
Health[Health Check]:::out
Logs[Logs Tab]:::out
Code[Code Tab]:::out
Predict[Predict Tab]:::out
end
List --> Metrics
List --> Health
List --> Logs
List --> Code
List --> Predict
classDef proc fill:#2196F3,color:#fff
classDef decide fill:#FF9800,color:#fff
classDef out fill:#9C27B0,color:#fffSchede di panoramica#
Quattro schede di riepilogo nella parte superiore della pagina mostrano:

| Metrica | Descrizione |
|---|---|
| Richieste totali (24h) | Richieste su tutti gli endpoint |
| Distribuzioni attive | Endpoint attualmente nello stato Ready |
| Tasso di errore (24h) | Quota di risposte con stato 4xx o 5xx, ponderata per il volume delle richieste |
| Latenza P95 (24h) | Media delle latenze orarie al 95° percentile, ponderata per volume |
Viene riportato il P95 anziché la latenza mediana poiché i controlli di integrità rispondono in un paio di millisecondi e altrimenti dominerebbero il quadro della reale latenza di inferenza.
La scheda del tasso di errore si evidenzia in rosso quando il tasso supera il 5%. Controlla la scheda Logs sulle singole distribuzioni per diagnosticare gli errori.
Mappa del mondo#
La mappa interattiva del mondo mostra:
- Pin della regione per tutte le 42 regioni disponibili
- Pin verdi per le aree geografiche con un deployment pronto
- Pin blu animati per le regioni con distribuzioni attive in corso
- La dimensione dei pin varia in base allo stato della distribuzione e alla latenza
Clicca su qualsiasi regione per aprire la finestra di dialogo New Deployment. La mappa è nascosta sugli schermi piccoli.

Elenco delle distribuzioni#
Sotto le schede di panoramica, l'elenco delle distribuzioni mostra tutti gli endpoint nei tuoi progetti. Usa il selettore della modalità di visualizzazione per passare tra:
| Visualizza | Descrizione |
|---|---|
| Schede | Schede di dettaglio complete con schede per metriche, log, codice e previsioni |
| Compatta | Griglia di schede più piccole (1-4 colonne) con metriche chiave |
| Tabella | DataTable con colonne ordinabili: Nome, Regione, Stato, Richieste, P95, Errori |
La dashboard si aggiorna automaticamente, eseguendo l'aggiornamento più frequentemente mentre i deployment si trovano in uno stato di transizione (creating, deploying o stopping). Clicca sul pulsante di aggiornamento per gli aggiornamenti immediati.
Metriche per singola distribuzione#
Ogni scheda di distribuzione (nella vista schede) mostra metriche in tempo reale:
Riga delle metriche#
| Metrica | Descrizione |
|---|---|
| Richieste | Numero di richieste nelle ultime 24 ore |
| Latenza P95 | Media delle latenze orarie al 95° percentile (24h) |
| Tasso di errore | Quota di risposte 4xx e 5xx, mostrata solo quando è superiore a 0 |
Le metriche si aggiornano automaticamente. Gli endpoint che non hanno servito alcuna richiesta mostrano "No traffic yet", e le metriche vengono raccolte solo per i deployment nello stato Ready. Sulla dashboard dei deployment, le metriche vengono recuperate per i 20 deployment più recenti.
Controllo Integrità#
Le distribuzioni in esecuzione mostrano un indicatore di controllo della salute:
| Indicatore | Significato |
|---|---|
| Cuore verde | Sano — mostra la latenza di risposta |
| Cuore rosso | Non sano — mostra il messaggio di errore |
| Icona rotante | Controllo della salute in corso |
I controlli di integrità riprovano automaticamente in caso di malfunzionamento e si interrompono non appena l'endpoint risponde. Clicca sull'icona di aggiornamento per attivare manualmente un controllo di integrità, che funge anche da metodo per riscaldare un endpoint ridotto a zero prima di inviare traffico.

Platform concede al controllo di integrità tempo extra e riprova in caso di errori di connessione temporanei, in modo che un endpoint ridotto a zero abbia il tempo di avviarsi. Se la scheda riporta "Service starting up...", aggiornala per rilevare un'istanza che nel frattempo ha completato l'avvio.
Log#
Ogni scheda di distribuzione include una scheda Logs per la visualizzazione delle voci di log recenti:

Voci di log#
Ogni voce di log mostra:
| Campo | Descrizione |
|---|---|
| Gravità | Barra codificata a colori (vedi sotto) |
| Timestamp | Ora della richiesta (formato locale) |
| Messaggio | Contenuto del log |
| Informazioni HTTP | Codice di stato e latenza (se applicabile) |
Ogni voce presenta una barra di gravità con codice colore:
| Livello | Colore | Descrizione |
|---|---|---|
| DEBUG | Grigio | Messaggi di debug |
| INFO | Blu | Richieste normali |
| WARNING | Ambra | Problemi non critici |
| ERROR | Rosso | Richieste fallite |
| CRITICAL | Rosso | Errori critici |
L'API accetta l'intero set di livelli di gravità dei log come filtro separato da virgole: DEBUG, INFO, NOTICE, WARNING, ERROR, CRITICAL, ALERT e EMERGENCY.
L'interfaccia utente mostra le 20 voci più recenti e nasconde quelle vuote. L'API prevede un valore predefinito di 50 voci per richiesta (massimo 200) e restituisce un nextPageToken per la paginazione all'indietro.
Durante l'indagine sugli errori: prima clicca su Errori per filtrare sulle voci ERROR e WARNING, quindi controlla i timestamp e i codici di stato HTTP. Copia i log negli appunti per condividerli con il tuo team.
Esempi di codice#
Ogni scheda di deployment include una scheda Code che mostra il codice API pronto all'uso con l'URL dell'endpoint compilato. Per i proprietari del workspace, viene inserita la chiave API associata al deployment, pronta per essere copiata ed eseguita. I non proprietari visualizzano un placeholder YOUR_API_KEY:
import requests
# Deployment endpoint
url = "https://YOUR_DEPLOYMENT_URL.run.app/predict"
# Headers with your deployment API key
headers = {"Authorization": "Bearer YOUR_API_KEY"}
# Inference parameters
data = {"conf": 0.25, "iou": 0.7, "imgsz": 640}
# Send image for inference
with open("image.jpg", "rb") as f:
response = requests.post(url, headers=headers, data=data, files={"file": f})
print(response.json())Quando visualizzi la scheda Code nella piattaforma, l'URL dell'endpoint e, per i proprietari del workspace, la chiave API associata al deployment vengono compilati automaticamente. Consulta API Keys per generare una chiave.
Previsione su deployment#
La scheda Predict su ciascuna scheda di distribuzione fornisce un pannello di predizione in linea — la stessa interfaccia della scheda Predict del modello, ma eseguendo l'inferenza tramite l'endpoint di distribuzione anziché il servizio condiviso. Questo è utile per testare un endpoint distribuito direttamente dal browser. Consulta Inferenza per i dettagli sui parametri e i formati di risposta.
Endpoint API#
Ogni deployment viene identificato dal proprietario e dal nome del deployment, e ogni rotta richiede una chiave API. Consulta la riferimento API per i dettagli sull'autenticazione.
Metriche di deployment#
GET /api/deployments/{owner}/{deployment}/metrics?range=24hRestituisce il payload completo delle metriche per un deployment: un blocco summary con richieste totali, conteggio e tasso di errori, e latenza media, P50, P95 e P99, oltre agli array timeSeries per richieste, errori, latenza P50 e P95, utilizzo di CPU e memoria e conteggio delle istanze.
| Parametro | Tipo | Descrizione |
|---|---|---|
range | stringa | Intervallo di tempo: 1h, 6h, 24h, 7d o 30d (predefinito 24h) |
sparkline | bool | Restituisce il riepilogo compatto della dashboard anziché il payload completo |
Con sparkline=true, la risposta corrisponde al formato compatto utilizzato dalle schede dei deployment: 24 conteggi di richieste orarie più richieste totali, tasso di errori e latenza media. Questa è la chiamata che si aggiorna ogni 60 secondi.
Log di deployment#
GET /api/deployments/{owner}/{deployment}/logs?limit=50&severity=ERROR,WARNINGRestituisce voci di log recenti con filtro di gravità opzionale e impaginazione.
| Parametro | Tipo | Descrizione |
|---|---|---|
limit | int | Numero massimo di voci da restituire (predefinito: 50, massimo: 200) |
severity | stringa | Filtro di gravità separato da virgole |
pageToken | stringa | Token di paginazione dalla risposta precedente |
Stato di salute del deployment#
GET /api/deployments/{owner}/{deployment}/healthEsegue il ping del deployment e restituisce il suo stato di integrità con la latenza di round-trip misurata:
{
"healthy": true,
"status": 200,
"latencyMs": 142
}Una risposta di non integrità omette status quando non è stato possibile raggiungere l'endpoint e aggiunge un messaggio error.
I numeri aggregati nella pagina Deploy non sono disponibili come singolo endpoint REST. Riproducili chiamando la rotta delle metriche per ciascun deployment restituito da GET /api/deployments/{owner}.
Ottimizzazione delle prestazioni#
Usa i dati di monitoraggio per ottimizzare i tuoi deployment:
Se la latenza è troppo elevata:
- Verifica che le dimensioni del modello siano appropriate
- Considera una regione più vicina
- Controlla le dimensioni dell'immagine inviate con ogni richiesta
Prova un valore imgsz più piccolo e confronta la latenza e l'accuratezza risultanti per il tuo modello. Distribuisci in una regione più vicina ai chiamanti per ridurre la latenza di rete.
FAQ#
L'API delle metriche supporta finestre selezionabili da 1 ora a 30 giorni, campionate in modo più grossolano man mano che la finestra cresce: bucket di 1 minuto su 1 ora fino a bucket di 4 ore su 30 giorni. La scheda di deployment mostra le 20 voci di log più recenti; l'API dei log può restituire fino a 200 voci per richiesta e supporta la paginazione.
Metriche e log vengono conservati solo finché esiste il deployment, quindi l'eliminazione di un deployment interrompe anche l'accesso alla sua cronologia. Esporta tutto ciò che desideri conservare prima di eliminare un endpoint.
Sì, la pagina dei deployment mostra tutti gli endpoint con schede di panoramica aggregate. Usa la visualizzazione a tabella per confrontare le prestazioni tra i vari deployment.
No. Le metriche e i controlli di integrità vengono raccolti solo per i deployment nello stato Ready. Un endpoint arrestato mantiene la sua scheda e la finestra cronologica ma non mostra dati in tempo reale finché non lo riavvii.