Monitoraggio#
Ultralytics Platform fornisce il monitoraggio per gli endpoint distribuiti. Tieni traccia delle metriche delle richieste, visualizza i log e controlla lo stato di salute con il polling automatico.

Dashboard delle distribuzioni#
La pagina Deploy nella barra laterale funge da dashboard di monitoraggio per tutte le tue distribuzioni. Combina la mappa del mondo, le metriche generali e la gestione delle distribuzioni in un'unica vista. Consulta Dedicated Endpoints per creare e gestire le distribuzioni.
graph TB
subgraph Dashboard
Map[World Map]:::proc --- Cards[Overview Cards]:::proc
Cards --- List[Deployments List]:::decide
end
subgraph "Per Deployment"
Metrics[Metrics Row]:::out
Health[Health Check]:::out
Logs[Logs Tab]:::out
Code[Code Tab]:::out
Predict[Predict Tab]:::out
end
List --> Metrics
List --> Health
List --> Logs
List --> Code
List --> Predict
classDef proc fill:#2196F3,color:#fff
classDef decide fill:#FF9800,color:#fff
classDef out fill:#9C27B0,color:#fffSchede di panoramica#
Quattro schede di riepilogo nella parte superiore della pagina mostrano:

| Metrica | Descrizione |
|---|---|
| Richieste totali (24h) | Richieste su tutti gli endpoint |
| Distribuzioni attive | Endpoint attualmente in esecuzione |
| Tasso di errore (24h) | Percentuale di richieste fallite |
| Latenza P95 (24h) | Tempo di risposta al 95° percentile |
La scheda del tasso di errore si illumina di rosso quando il tasso supera il 5%. Controlla la scheda Logs sulle singole distribuzioni per diagnosticare gli errori.
Mappa del mondo#
La mappa interattiva del mondo mostra:
- Pin della regione per tutte le 42 regioni disponibili
- Pin verdi per le regioni con distribuzioni attive
- Pin blu animati per le regioni con distribuzioni attive in corso
- La dimensione dei pin varia in base allo stato della distribuzione e alla latenza

Elenco delle distribuzioni#
Sotto le schede di panoramica, l'elenco delle distribuzioni mostra tutti gli endpoint nei tuoi progetti. Usa il selettore della modalità di visualizzazione per passare tra:
| Visualizza | Descrizione |
|---|---|
| Schede | Schede di dettaglio complete con schede per metriche, log, codice e previsioni |
| Compatta | Griglia di schede più piccole (1-4 colonne) con metriche chiave |
| Tabella | DataTable con colonne ordinabili: Nome, Regione, Stato, Richieste, P95, Errori |
Il dashboard esegue il polling ogni 15 secondi per gli aggiornamenti sullo stato del deployment. Quando i deployment si trovano in uno stato transitorio (creating, deploying o stopping), il polling aumenta a ogni 3 secondi. Le metriche per singolo deployment si aggiornano ogni 60 secondi. Fai clic sul pulsante di aggiornamento per avere dati immediati.
Metriche per singola distribuzione#
Ogni scheda di distribuzione (nella vista schede) mostra metriche in tempo reale:
Riga delle metriche#
| Metrica | Descrizione |
|---|---|
| Richieste | Conteggio delle richieste (24h) con icona |
| Latenza P95 | Tempo di risposta al 95° percentile |
| Tasso di errore | Percentuale di richieste fallite |
Le metriche vengono recuperate dall'endpoint API sparkline e si aggiornano ogni 60 secondi.
Controllo Integrità#
Le distribuzioni in esecuzione mostrano un indicatore di controllo della salute:
| Indicatore | Significato |
|---|---|
| Cuore verde | Sano — mostra la latenza di risposta |
| Cuore rosso | Non sano — mostra il messaggio di errore |
| Icona rotante | Controllo della salute in corso |
I controlli di salute riprovano automaticamente ogni 20 secondi quando non sono sani. Clicca sull'icona di aggiornamento per attivare manualmente un controllo della salute. Il controllo della salute utilizza un timeout di 55 secondi per adattarsi agli avvii a freddo sugli endpoint scale-to-zero.

La richiesta di controllo dello stato consente fino a 55 secondi in modo che un endpoint con ridimensionamento a zero abbia il tempo di avviarsi.
Log#
Ogni scheda di distribuzione include una scheda Logs per visualizzare le voci di log recenti:

Voci di log#
Ogni voce di log mostra:
| Campo | Descrizione |
|---|---|
| Gravità | Barra codificata a colori (vedi sotto) |
| Timestamp | Ora della richiesta (formato locale) |
| Messaggio | Contenuto del log |
| Informazioni HTTP | Codice di stato e latenza (se applicabile) |
Filtra i log per gravità usando i pulsanti di filtro:
| Livello | Colore | Descrizione |
|---|---|---|
| DEBUG | Grigio | Messaggi di debug |
| INFO | Blu | Richieste normali |
| WARNING | Giallo | Problemi non critici |
| ERROR | Rosso | Richieste fallite |
| CRITICAL | Rosso scuro | Errori critici |
L'interfaccia mostra le 20 voci più recenti. L'API imposta di default 50 voci per richiesta (massimo 200).
Durante l'indagine sugli errori: prima clicca su Errori per filtrare sulle voci ERROR e WARNING, quindi controlla i timestamp e i codici di stato HTTP. Copia i log negli appunti per condividerli con il tuo team.
Esempi di codice#
Ogni scheda di distribuzione include una scheda Code che mostra codice API pronto all'uso con il tuo URL endpoint effettivo e la chiave API:
import requests
# Deployment endpoint
url = "https://predict-abc123.run.app/predict"
# Headers with your deployment API key
headers = {"Authorization": "Bearer YOUR_API_KEY"}
# Inference parameters
data = {"conf": 0.25, "iou": 0.7, "imgsz": 640}
# Send image for inference
with open("image.jpg", "rb") as f:
response = requests.post(url, headers=headers, data=data, files={"file": f})
print(response.json())Quando visualizzi la scheda Code nella piattaforma, il tuo URL endpoint e la chiave API vengono compilati automaticamente. Copia il codice ed eseguilo direttamente. Consulta API Keys per generare una chiave.
Previsione su deployment#
La scheda Predict su ogni scheda di deployment fornisce un pannello di previsione integrato: la stessa interfaccia della scheda Predict del modello, ma che esegue l'inferenza tramite l'endpoint di deployment invece che tramite il servizio condiviso. Questo è utile per testare un endpoint distribuito direttamente dal browser. Consulta Inference per i dettagli sui parametri e i formati di risposta.
Endpoint API#
Panoramica del monitoraggio#
GET /api/monitoringRestituisce metriche aggregate per tutti i deployment di proprietà dell'utente autenticato. Consapevole dell'area di lavoro tramite il parametro di query opzionale owner.
Metriche di deployment#
GET /api/deployments/{deploymentId}/metrics?sparkline=true&range=24hRestituisce dati sparkline e metriche di riepilogo per uno specifico deployment. Intervallo di aggiornamento: 60 secondi.
| Parametro | Tipo | Descrizione |
|---|---|---|
sparkline | bool | Includi dati sparkline |
range | stringa | Intervallo di tempo: 1h, 6h, 24h, 7d o 30d |
Log di deployment#
GET /api/deployments/{deploymentId}/logs?limit=50&severity=ERROR,WARNINGRestituisce voci di log recenti con filtro di gravità opzionale e impaginazione.
| Parametro | Tipo | Descrizione |
|---|---|---|
limit | int | Numero massimo di voci da restituire (predefinito: 50, massimo: 200) |
severity | stringa | Filtro di gravità separato da virgole |
pageToken | stringa | Token di paginazione dalla risposta precedente |
Stato di salute del deployment#
GET /api/deployments/{deploymentId}/healthRestituisce lo stato del controllo di integrità con la latenza di risposta.
{
"healthy": true,
"status": 200,
"latencyMs": 142,
"serverTiming": { "db": 8, "ping": 142, "total": 150 }
}Ottimizzazione delle prestazioni#
Usa i dati di monitoraggio per ottimizzare i tuoi deployment:
Se la latenza è troppo elevata:
- Verifica che le dimensioni del modello siano appropriate
- Considera una regione più vicina
- Controlla le dimensioni dell'immagine inviate con ogni richiesta
Prova un valore imgsz più piccolo e confronta la latenza e l'accuratezza risultanti per il tuo modello. Esegui il deployment in una regione più vicina ai chiamanti per ridurre la latenza di rete.
FAQ#
Per quanto tempo vengono conservati i dati?#
L'API delle metriche supporta finestre selezionabili da 1 ora a 30 giorni. La scheda del deployment mostra le 20 voci di log più recenti; l'API dei log può restituire fino a 200 voci per richiesta e supporta la paginazione.
Posso monitorare più endpoint insieme?#
Sì, la pagina dei deployment mostra tutti gli endpoint con schede di panoramica aggregate. Usa la visualizzazione a tabella per confrontare le prestazioni tra i vari deployment.