Monitoramento#
Ultralytics Platform fornece monitoramento para endpoints implantados. Rastreie métricas de requisição, visualize logs e verifique o status de integridade com polling automático.

Painel de Implantações#
A página Deploy na barra lateral serve como o painel de monitoramento para todas as tuas implantações. Ela combina o mapa-múndi, métricas de visão geral e gerenciamento de implantações em uma única visualização. Consulte Dedicated Endpoints para criar e gerenciar implantações.
graph TB
subgraph Dashboard
Map[World Map]:::proc --- Cards[Overview Cards]:::proc
Cards --- List[Deployments List]:::decide
end
subgraph "Per Ready Deployment"
Metrics[Metrics Row]:::out
Health[Health Check]:::out
Logs[Logs Tab]:::out
Code[Code Tab]:::out
Predict[Predict Tab]:::out
end
List --> Metrics
List --> Health
List --> Logs
List --> Code
List --> Predict
classDef proc fill:#2196F3,color:#fff
classDef decide fill:#FF9800,color:#fff
classDef out fill:#9C27B0,color:#fffCartões de Visão Geral#
Quatro cartões de resumo na parte superior da página mostram:

| Métrica | Descrição |
|---|---|
| Total de Solicitações (24h) | Solicitações em todos os endpoints |
| Implantações Ativas | Endpoints atualmente no estado Ready |
| Taxa de Erro (24h) | Parcela de respostas com um status 4xx ou 5xx, ponderada pelo volume de solicitações |
| Latência P95 (24h) | Média das latências horárias no 95º percentil, ponderada pelo volume |
O P95 em vez da latência mediana é relatado porque as verificações de integridade retornam em alguns milissegundos e, caso contrário, dominariam o panorama da latência de inferência real.
O cartão de taxa de erro fica destacado em vermelho quando a taxa excede 5%. Verifique a aba Logs em implantações individuais para diagnosticar erros.
Mapa-Múndi#
O mapa-múndi interativo mostra:
- Fixadores de região para todas as 42 regiões disponíveis
- Pinos verdes para regiões com um deployment pronto
- Marcadores azuis animados para regiões com implantações ativas em andamento
- O tamanho do marcador varia conforme o status da implantação e a latência
Clica em qualquer região para abrir o diálogo New Deployment. O mapa fica oculto em telas pequenas.

Lista de Implantações#
Abaixo dos cartões de visão geral, a lista de implantações mostra todos os endpoints em seus projetos. Use o botão de modo de visualização para alternar entre:
| Ver | Descrição |
|---|---|
| Cartões | Cartões de detalhes completos com abas de métricas, logs, código e predição |
| Compacto | Grade de cartões menores (1-4 colunas) com métricas principais |
| Tabela | Tabela de dados com colunas classificáveis: Nome, Região, Status, Solicitações, P95, Erros |
O painel é atualizado automaticamente, atualizando mais rapidamente enquanto os deployments estão em um estado de transição (creating, deploying ou stopping). Clica no botão de atualizar para obter atualizações imediatas.
Métricas por Implantação#
Cada cartão de implantação (na vista de cartões) mostra métricas em tempo real. A linha de métricas, a verificação de integridade e as abas Logs, Code e Predict descritas abaixo aparecem apenas enquanto a implantação estiver Pronta:
Linha de Métricas#
| Métrica | Descrição |
|---|---|
| Solicitações | Contagem de solicitações nas últimas 24 horas |
| Latência P95 | Média das latências horárias no 95º percentil (24h) |
| Taxa de Erro | Parcela de respostas 4xx e 5xx, exibida apenas quando acima de 0 |
As métricas são atualizadas automaticamente. Endpoints que não serviram nenhuma solicitação mostram "No traffic yet", e as métricas são coletadas apenas para deployments no estado Ready. No painel de deployments, as métricas são buscadas para os 20 deployments mais recentes.
Verificação de Saúde#
As implantações em execução mostram um indicador de verificação de integridade:
| Indicador | Significado |
|---|---|
| Coração verde | Saudável — mostra a latência de resposta |
| Coração vermelho | Não saudável — mostra a mensagem de erro |
| Ícone giratório | Verificação de integridade em andamento |
As verificações de integridade tentam novamente de forma automática enquanto estiverem com problemas e param assim que o endpoint responder. Clica no ícone de atualizar para acionar manualmente uma verificação de integridade, que também serve como uma forma de aquecer um endpoint dimensionado para zero antes de enviar tráfego.

A plataforma dá tempo extra para a verificação de integridade e tenta novamente falhas de conexão transitórias, para que um endpoint dimensionado para zero tenha tempo de iniciar. Se o cartão relatar "Service starting up...", atualiza-o para apanhar uma instância que terminou de inicializar entretanto.
Logs#
Cada cartão de implantação inclui uma aba Logs para visualizar entradas de log recentes:

Entradas de Log#
Cada entrada de log mostra:
| Campo | Descrição |
|---|---|
| Severidade | Barra codificada por cores (veja abaixo) |
| Carimbo de data/hora | Hora da solicitação (formato local) |
| Mensagem | Conteúdo do log |
| Informações HTTP | Código de status e latência (se aplicável) |
Cada entrada possui uma barra de gravidade colorida:
| Nível | Cor | Descrição |
|---|---|---|
| DEBUG | Cinza | Mensagens de depuração |
| INFO | Azul | Solicitações normais |
| WARNING | Âmbar | Problemas não críticos |
| ERROR | Vermelho | Solicitações com falha |
| CRITICAL | Vermelho | Falhas críticas |
A API aceita o conjunto completo de gravidades de logs como um filtro separado por vírgulas: DEBUG, INFO, NOTICE, WARNING, ERROR, CRITICAL, ALERT e EMERGENCY.
A IU mostra as 20 entradas mais recentes e oculta as vazias. A API assume como padrão 50 entradas por solicitação (máx. 200) e retorna um nextPageToken para paginação mais retroativa.
Ao investigar erros: primeiro clique em Erros para filtrar para entradas ERROR e WARNING, depois revise os carimbos de data/hora e os códigos de status HTTP. Copie os logs para a área de transferência para compartilhar com sua equipe.
Exemplos de Código#
Cada cartão de deployment inclui uma aba Code que mostra código de API pronto a usar com o URL do endpoint preenchido. Para os proprietários de espaços de trabalho, a chave de API vinculada do deployment é inserida, pronta para copiar e executar. Os não proprietários veem um espaço reservado YOUR_API_KEY:
import requests
# Deployment endpoint
url = "https://YOUR_DEPLOYMENT_URL.run.app/predict"
# Headers with your deployment API key
headers = {"Authorization": "Bearer YOUR_API_KEY"}
# Inference parameters
data = {"conf": 0.25, "iou": 0.7, "imgsz": 640}
# Send image for inference
with open("image.jpg", "rb") as f:
response = requests.post(url, headers=headers, data=data, files={"file": f})
print(response.json())Ao visualizar a aba Code na plataforma, o URL do endpoint e, para os proprietários de espaços de trabalho, a chave de API vinculada do deployment são preenchidas para ti. Consulta API Keys para gerar uma chave.
Previsão de Implementação#
A aba Predict em cada cartão de implantação fornece um painel de previsão embutido — a mesma interface da aba Predict do modelo, mas executando inferência através do endpoint de implantação em vez do serviço compartilhado. Isso é útil para testar um endpoint implantado diretamente a partir do navegador. Consulte Inference para detalhes de parâmetros e formatos de resposta.
Endpoints de API#
Cada deployment é endereçado pelo seu proprietário e nome de deployment, e cada rota requer uma chave de API. Consulta a referência da API para obter detalhes de autenticação.
Métricas de implantação#
GET /api/deployments/{owner}/{deployment}/metrics?range=24hSDK Python: client.deployments.metrics(owner, deployment, range="24h")
Retorna o payload completo de métricas para um deployment: um bloco summary com o total de solicitações, contagem e taxa de erros, e latência média, P50, P95 e P99, além de arrays timeSeries para solicitações, erros, latência P50 e P95, utilização de CPU e memória, e contagem de instâncias.
| Parâmetro | Tipo | Descrição |
|---|---|---|
range | string | Intervalo de tempo: 1h, 6h, 24h, 7d ou 30d (padrão 24h) |
sparkline | bool | Retornar o resumo compacto do painel em vez do payload completo |
Com sparkline=true, a resposta é a forma compacta que os cartões de deployment utilizam — 24 contagens de solicitações horárias mais o total de solicitações, taxa de erro e latência média. Esta é a chamada que é atualizada a cada 60 segundos.
Logs de implantação#
GET /api/deployments/{owner}/{deployment}/logs?limit=50&severity=ERROR,WARNINGSDK Python: client.deployments.logs(owner, deployment, limit=50, severity="ERROR,WARNING")
Retorna entradas de log recentes com filtro de severidade e paginação opcionais.
| Parâmetro | Tipo | Descrição |
|---|---|---|
limit | int | Número máximo de entradas para retornar (padrão: 50, máximo: 200) |
severity | string | Filtro de severidade separado por vírgula |
pageToken | string | Token de paginação da resposta anterior |
Saúde da implantação#
GET /api/deployments/{owner}/{deployment}/healthSDK Python: client.deployments.health(owner, deployment)
Faz ping no deployment e retorna o respetivo status de integridade com a latência de ida e volta medida:
{
"healthy": true,
"status": 200,
"latencyMs": 142
}Uma resposta com problemas omite status quando o endpoint não pôde ser alcançado de todo, e adiciona uma mensagem error.
Os números agregados na página Deploy não estão disponíveis como um único endpoint REST. Reproduze-os chamando a rota de métricas para cada implantação retornada por GET /api/deployments/{owner} (client.deployments.list(owner)).
Otimização de Desempenho#
Use dados de monitoramento para otimizar suas implantações:
Se a latência estiver muito alta:
- Verifica se o tamanho do modelo é adequado
- Considere uma região mais próxima
- Verifica o tamanho da imagem enviada com cada pedido
Tente um valor menor de imgsz e compare a latência e a precisão resultantes para o teu modelo. Implante em uma região mais próxima dos chamadores para reduzir a latência de rede.
FAQ#
A API de métricas suporta janelas selecionáveis de 1 hora até 30 dias, amostradas de forma mais grosseira à medida que a janela cresce — blocos de 1 minuto ao longo de 1 hora até blocos de 4 horas ao longo de 30 dias. O cartão de deployment mostra as 20 entradas de log mais recentes; a API de logs pode retornar até 200 entradas por solicitação e suporta paginação.
As métricas e os logs são retidos apenas enquanto o deployment existir, pelo que eliminar um deployment também encerra o acesso ao seu histórico. Exporta tudo o que precisas de manter antes de eliminar um endpoint.
Sim, a página de implantações mostra todos os endpoints com cartões de visão geral agregados. Use a visualização em tabela para comparar o desempenho entre as implantações.
Não. As métricas e as verificações de integridade são coletadas apenas para deployments no estado Ready. Um endpoint parado mantém o seu cartão e janela de histórico, mas não mostra números ao vivo até o iniciares novamente.