Monitorização#
A Ultralytics Platform fornece monitorização para endpoints implementados. Acompanha as métricas dos pedidos, consulta os registos e verifica o estado de funcionamento com sondagem automática.

Painel de implementações#
A página Deploy na barra lateral funciona como painel de monitorização de todas as tuas implementações. Combina o mapa-múndi, as métricas de visão geral e a gestão de implementações numa única vista. Consulta Dedicated Endpoints para criar e gerir implementações.
graph TB
subgraph Dashboard
Map[World Map]:::proc --- Cards[Overview Cards]:::proc
Cards --- List[Deployments List]:::decide
end
subgraph "Per Ready Deployment"
Metrics[Metrics Row]:::out
Health[Health Check]:::out
Logs[Logs Tab]:::out
Code[Code Tab]:::out
Predict[Predict Tab]:::out
end
List --> Metrics
List --> Health
List --> Logs
List --> Code
List --> Predict
classDef proc fill:#2196F3,color:#fff
classDef decide fill:#FF9800,color:#fff
classDef out fill:#9C27B0,color:#fffCartões de visão geral#
Os quatro cartões de resumo no topo da página mostram:

| Métrica | Descrição |
|---|---|
| Total de pedidos (24 h) | Pedidos em todos os endpoints |
| Implementações ativas | Endpoints atualmente no estado Ready |
| Taxa de erros (24 h) | Percentagem de respostas com estado 4xx ou 5xx, ponderada pelo volume de pedidos |
| Latência P95 (24 h) | Média das latências do percentil 95 por hora, ponderada pelo volume |
É comunicada a latência P95, em vez da latência mediana, porque as verificações de funcionamento demoram alguns milissegundos e, caso contrário, dominariam a representação da latência real de inferência.
O cartão da taxa de erros fica vermelho quando a taxa excede 5%. Consulta o separador Logs em implementações individuais para diagnosticar erros.
Mapa-múndi#
O mapa-múndi interativo mostra:
- Marcadores de região para todas as 42 regiões disponíveis
- Marcadores verdes para regiões com uma implementação pronta
- Marcadores azuis animados para regiões com implementações ativas em curso
- O tamanho do marcador varia consoante o estado da implementação e a latência
Clica em qualquer região para abrir a caixa de diálogo New Deployment. O mapa fica oculto em ecrãs pequenos.

Lista de implementações#
Abaixo dos cartões de visão geral, a lista de implementações mostra todos os endpoints dos teus projetos. Usa o seletor do modo de visualização para alternar entre:
| Vista | Descrição |
|---|---|
| Cartões | Cartões detalhados com métricas, registos, código e separadores de previsão |
| Compacto | Grelha de cartões mais pequenos (1–4 colunas) com métricas essenciais |
| Tabela | DataTable com colunas ordenáveis: Nome, Região, Estado, Pedidos, P95, Erros |
O painel é atualizado automaticamente, com uma frequência maior enquanto as implementações estão num estado de transição (creating, deploying ou stopping). Clica no botão de atualização para obter atualizações imediatas.
Métricas por implementação#
Cada cartão de implementação (na vista de cartões) mostra métricas em tempo real. A linha de métricas, a verificação de funcionamento e os separadores Logs, Code e Predict descritos abaixo aparecem apenas enquanto a implementação estiver Ready:
Linha de métricas#
| Métrica | Descrição |
|---|---|
| Pedidos | Contagem de pedidos nas últimas 24 horas |
| Latência P95 | Média das latências do percentil 95 por hora (24 h) |
| Taxa de erros | Percentagem de respostas 4xx e 5xx, apresentada apenas quando é superior a 0 |
As métricas são atualizadas automaticamente. Os endpoints que ainda não processaram nenhum pedido mostram "Ainda sem tráfego" e as métricas só são recolhidas para implementações no estado Ready. No painel de implementações, as métricas são obtidas para as 20 implementações mais recentes.
Verificação de integridade#
As implementações em execução mostram um indicador de verificação de funcionamento:
| Indicador | Significado |
|---|---|
| Coração verde | Saudável — mostra a latência da resposta |
| Coração vermelho | Não saudável — mostra a mensagem de erro |
| Ícone giratório | Verificação de funcionamento em curso |
As verificações de funcionamento são repetidas automaticamente enquanto o endpoint não está saudável e param assim que o endpoint responde. Clica no ícone de atualização para acionar manualmente uma verificação de funcionamento, que também funciona como forma de aquecer um endpoint reduzido a zero antes de enviar tráfego.

A plataforma dá tempo adicional à verificação de funcionamento e repete as tentativas em caso de falhas de ligação transitórias, para que um endpoint reduzido a zero tenha tempo de iniciar. Se o cartão apresentar "A iniciar o serviço...", atualiza-o para detetar uma instância que tenha terminado o arranque entretanto.
Registos#
Cada cartão de implementação inclui um separador Logs para consultar as entradas de registo recentes:

Entradas de registo#
Cada entrada de registo mostra:
| Campo | Descrição |
|---|---|
| Gravidade | Barra codificada por cores (ver abaixo) |
| Carimbo de data/hora | Hora do pedido (formato local) |
| Mensagem | Conteúdo do registo |
| Informações HTTP | Código de estado e latência (se aplicável) |
Cada entrada inclui uma barra de gravidade codificada por cores:
| Nível | Cor | Descrição |
|---|---|---|
| DEBUG | Cinzento | Mensagens de depuração |
| INFO | Azul | Pedidos normais |
| WARNING | Âmbar | Problemas não críticos |
| ERROR | Vermelho | Pedidos falhados |
| CRITICAL | Vermelho | Falhas críticas |
A API aceita o conjunto completo de gravidades de registo como filtro separado por vírgulas: DEBUG, INFO, NOTICE, WARNING, ERROR, CRITICAL, ALERT e EMERGENCY.
A interface mostra as 20 entradas mais recentes e oculta as vazias. Por predefinição, a API devolve 50 entradas por pedido (máximo de 200) e
retorna um nextPageToken para paginar mais para trás.
Ao investigar erros: primeiro clica em Errors para filtrar as entradas ERROR e WARNING e, em seguida, revê os carimbos de data/hora e os códigos de estado HTTP. Copia os registos para a área de transferência para os partilhares com a tua equipa.
Exemplos de código#
Cada cartão de implementação inclui um separador Code que mostra código de API pronto a utilizar, com o URL do endpoint preenchido. Para os
proprietários do workspace, a chave de API associada à implementação é inserida, pronta para copiar e executar. Os não proprietários veem um
marcador de posição YOUR_API_KEY:
import requests
# Deployment endpoint
url = "https://YOUR_DEPLOYMENT_URL.run.app/predict"
# Headers with your deployment API key
headers = {"Authorization": "Bearer YOUR_API_KEY"}
# Inference parameters
data = {"conf": 0.25, "iou": 0.7, "imgsz": 640}
# Send image for inference
with open("image.jpg", "rb") as f:
response = requests.post(url, headers=headers, data=data, files={"file": f})
print(response.json())Ao veres o separador Code na plataforma, o URL do endpoint e, para os proprietários do workspace, a chave de API associada à implementação são preenchidos automaticamente. Consulta Chaves de API para gerar uma chave.
Previsão da implementação#
O separador Predict em cada cartão de implementação fornece um painel de previsão integrado — a mesma interface do separador Predict do modelo, mas executando a inferência através do endpoint de implementação em vez do serviço partilhado. Isto é útil para testar um endpoint implementado diretamente a partir do navegador. Consulta Inferência para obter detalhes sobre os parâmetros e os formatos das respostas.
Endpoints da API#
Cada implementação é identificada pelo seu proprietário e nome, e cada rota requer uma chave de API. Consulta a referência da API para obter detalhes sobre a autenticação.
Métricas da implementação#
GET /api/deployments/{owner}/{deployment}/metrics?range=24hSDK Python: client.deployments.metrics(owner, deployment, range="24h")
Devolve o payload completo de métricas de uma implementação: um bloco summary com o total de pedidos, a contagem e a taxa de erros e as latências média, P50, P95 e P99, além de
matrizes timeSeries para pedidos, erros e latências P50 e P95, utilização de CPU e memória e contagem de instâncias.
| Parâmetro | Tipo | Descrição |
|---|---|---|
range | string | Intervalo de tempo: 1h, 6h, 24h, 7d ou 30d (predefinição: 24h) |
sparkline | bool | Devolve o resumo compacto do dashboard em vez do payload completo |
Com sparkline=true, a resposta apresenta o formato compacto utilizado pelos cartões de implementação — 24 contagens horárias de pedidos, além do total de
pedidos, da taxa de erros e da latência média. Esta é a chamada que é atualizada a cada 60 segundos.
Registos da implementação#
GET /api/deployments/{owner}/{deployment}/logs?limit=50&severity=ERROR,WARNINGSDK Python: client.deployments.logs(owner, deployment, limit=50, severity="ERROR,WARNING")
Devolve entradas de registo recentes com filtro de gravidade e paginação opcionais.
| Parâmetro | Tipo | Descrição |
|---|---|---|
limit | int | Número máximo de entradas a devolver (predefinição: 50, máximo: 200) |
severity | string | Filtro de gravidade separado por vírgulas |
pageToken | string | Token de paginação da resposta anterior |
Estado da implementação#
GET /api/deployments/{owner}/{deployment}/healthSDK Python: client.deployments.health(owner, deployment)
Faz ping à implementação e devolve o respetivo estado de funcionamento com a latência de ida e volta medida:
{
"healthy": true,
"status": 200,
"latencyMs": 142
}Uma resposta de estado não saudável omite status quando não foi possível alcançar o endpoint, e adiciona uma mensagem error.
Os números agregados na página Deploy não estão disponíveis como um único endpoint REST. Reprodu-los chamando a rota de métricas para cada implementação devolvida por GET /api/deployments/{owner} (client.deployments.list(owner)).
Otimização do desempenho#
Utiliza os dados de monitorização para otimizar as tuas implementações:
Se a latência for demasiado elevada:
- Verifica se o tamanho do modelo é adequado
- Considera uma região mais próxima
- Verifica o tamanho da imagem enviada com cada pedido
Experimenta um valor imgsz menor e compara a latência e a precisão resultantes do teu modelo. Implementa numa região
mais próxima dos autores das chamadas para reduzir a latência da rede.
Perguntas frequentes#
A API de métricas suporta janelas selecionáveis de 1 hora a 30 dias, com uma amostragem progressivamente menos granular à medida que a janela aumenta — intervalos de 1 minuto numa janela de 1 hora até intervalos de 4 horas numa janela de 30 dias. O cartão da implementação mostra as 20 entradas de registo mais recentes; a API de registos pode devolver até 200 entradas por pedido e suporta paginação.
As métricas e os registos são retidos apenas enquanto a implementação existir, pelo que eliminar uma implementação também termina o acesso ao seu histórico. Exporta tudo o que precisares de conservar antes de eliminares um endpoint.
Sim, a página de implementações mostra todos os endpoints com cartões de visão geral agregada. Utiliza a vista de tabela para comparar o desempenho entre implementações.
Não. As métricas e as verificações de estado são recolhidas apenas para implementações no estado Ready. Um endpoint parado mantém o seu cartão e a janela de histórico, mas não mostra números em tempo real até ser iniciado novamente.