Monitoramento#
A Ultralytics Platform fornece monitoramento para endpoints implantados. Acompanha métricas de requisições, visualiza logs e verifica o status de integridade com polling automático.

Painel de Implantações#
A página Deploy na barra lateral serve como painel de monitoramento para todas as suas implantações. Ela combina o mapa-múndi, métricas de visão geral e gerenciamento de implantação em uma única visualização. Consulte Endpoints Dedicados para criar e gerenciar implantações.
graph TB
subgraph Dashboard
Map[World Map]:::proc --- Cards[Overview Cards]:::proc
Cards --- List[Deployments List]:::decide
end
subgraph "Per Deployment"
Metrics[Metrics Row]:::out
Health[Health Check]:::out
Logs[Logs Tab]:::out
Code[Code Tab]:::out
Predict[Predict Tab]:::out
end
List --> Metrics
List --> Health
List --> Logs
List --> Code
List --> Predict
classDef proc fill:#2196F3,color:#fff
classDef decide fill:#FF9800,color:#fff
classDef out fill:#9C27B0,color:#fffCartões de Visão Geral#
Quatro cartões de resumo na parte superior da página mostram:

| Métrica | Descrição |
|---|---|
| Total de Solicitações (24h) | Solicitações em todos os endpoints |
| Implantações Ativas | Endpoints em execução no momento |
| Taxa de Erro (24h) | Porcentagem de solicitações com falha |
| Latência P95 (24h) | Tempo de resposta no percentil 95 |
O cartão de taxa de erro fica destacado em vermelho quando a taxa excede 5%. Verifique a aba Logs em cada implantação para diagnosticar erros.
Mapa-Múndi#
O mapa-múndi interativo mostra:
- Fixadores de região para todas as 42 regiões disponíveis
- Marcadores verdes para regiões implantadas
- Marcadores azuis animados para regiões com implantações ativas em andamento
- O tamanho do marcador varia conforme o status da implantação e a latência

Lista de Implantações#
Abaixo dos cartões de visão geral, a lista de implantações mostra todos os endpoints em seus projetos. Use o botão de modo de visualização para alternar entre:
| Ver | Descrição |
|---|---|
| Cartões | Cartões de detalhes completos com abas de métricas, logs, código e predição |
| Compacto | Grade de cartões menores (1-4 colunas) com métricas principais |
| Tabela | Tabela de dados com colunas classificáveis: Nome, Região, Status, Solicitações, P95, Erros |
O painel consulta o estado das implementações a cada 15 segundos para obter atualizações. Quando as implementações estão num estado de transição (creating, deploying ou stopping), as consultas aumentam para cada 3 segundos. As métricas por implementação são atualizadas a cada 60 segundos. Clica no botão de atualizar para obter atualizações imediatas.
Métricas por Implantação#
Cada cartão de implantação (na visualização de cartões) mostra métricas em tempo real:
Linha de Métricas#
| Métrica | Descrição |
|---|---|
| Solicitações | Contagem de solicitações (24h) com ícone |
| Latência P95 | Tempo de resposta no percentil 95 |
| Taxa de Erro | Porcentagem de solicitações com falha |
As métricas são buscadas no endpoint da API de sparkline e atualizadas a cada 60 segundos.
Verificação de Saúde#
As implantações em execução mostram um indicador de verificação de integridade:
| Indicador | Significado |
|---|---|
| Coração verde | Saudável — mostra a latência de resposta |
| Coração vermelho | Não saudável — mostra a mensagem de erro |
| Ícone giratório | Verificação de integridade em andamento |
As verificações de integridade tentam novamente automaticamente a cada 20 segundos quando não estão saudáveis. Clique no ícone de atualização para acionar manualmente uma verificação de integridade. A verificação de integridade usa um tempo limite de 55 segundos para acomodar cold starts em endpoints com escala para zero.

O pedido de verificação de estado permite até 55 segundos para que um endpoint dimensionado para zero tenha tempo de iniciar.
Logs#
Cada cartão de implantação inclui uma aba Logs para visualizar entradas de log recentes:

Entradas de Log#
Cada entrada de log mostra:
| Campo | Descrição |
|---|---|
| Severidade | Barra codificada por cores (veja abaixo) |
| Carimbo de data/hora | Hora da solicitação (formato local) |
| Mensagem | Conteúdo do log |
| Informações HTTP | Código de status e latência (se aplicável) |
Filtre logs por severidade usando os botões de filtro:
| Nível | Cor | Descrição |
|---|---|---|
| DEBUG | Cinza | Mensagens de depuração |
| INFO | Azul | Solicitações normais |
| WARNING | Amarelo | Problemas não críticos |
| ERROR | Vermelho | Solicitações com falha |
| CRITICAL | Vermelho Escuro | Falhas críticas |
A interface mostra as 20 entradas mais recentes. A API define como padrão 50 entradas por solicitação (máximo de 200).
Ao investigar erros: primeiro clique em Erros para filtrar para entradas ERROR e WARNING, depois revise os carimbos de data/hora e os códigos de status HTTP. Copie os logs para a área de transferência para compartilhar com sua equipe.
Exemplos de Código#
Cada cartão de implantação inclui uma aba Code mostrando código de API pronto para uso com seu URL de endpoint real e chave de API:
import requests
# Deployment endpoint
url = "https://predict-abc123.run.app/predict"
# Headers with your deployment API key
headers = {"Authorization": "Bearer YOUR_API_KEY"}
# Inference parameters
data = {"conf": 0.25, "iou": 0.7, "imgsz": 640}
# Send image for inference
with open("image.jpg", "rb") as f:
response = requests.post(url, headers=headers, data=data, files={"file": f})
print(response.json())Ao visualizar a aba Code na plataforma, seu URL de endpoint real e chave de API são preenchidos automaticamente. Copie o código e execute-o diretamente. Consulte Chaves de API para gerar uma chave.
Previsão de Implementação#
A guia Predict em cada cartão de implantação fornece um painel de predição integrado — a mesma interface da guia Predict do modelo, mas executando a inferência através do endpoint de implantação em vez do serviço compartilhado. Isso é útil para testar um endpoint implantado diretamente do navegador. Veja Inference para detalhes de parâmetros e formatos de resposta.
Endpoints de API#
Visão geral de monitoramento#
GET /api/monitoringRetorna métricas agregadas para todas as implantações de propriedade do usuário autenticado. Ciente do workspace através do parâmetro de consulta opcional owner.
Métricas de implantação#
GET /api/deployments/{deploymentId}/metrics?sparkline=true&range=24hRetorna dados de sparkline e métricas de resumo para uma implantação específica. Intervalo de atualização: 60 segundos.
| Parâmetro | Tipo | Descrição |
|---|---|---|
sparkline | bool | Incluir dados de sparkline |
range | string | Intervalo de tempo: 1h, 6h, 24h, 7d ou 30d |
Logs de implantação#
GET /api/deployments/{deploymentId}/logs?limit=50&severity=ERROR,WARNINGRetorna entradas de log recentes com filtro de severidade e paginação opcionais.
| Parâmetro | Tipo | Descrição |
|---|---|---|
limit | int | Número máximo de entradas para retornar (padrão: 50, máximo: 200) |
severity | string | Filtro de severidade separado por vírgula |
pageToken | string | Token de paginação da resposta anterior |
Saúde da implantação#
GET /api/deployments/{deploymentId}/healthRetorna o status da verificação de saúde com latência de resposta.
{
"healthy": true,
"status": 200,
"latencyMs": 142,
"serverTiming": { "db": 8, "ping": 142, "total": 150 }
}Otimização de Desempenho#
Use dados de monitoramento para otimizar suas implantações:
Se a latência estiver muito alta:
- Verifica se o tamanho do modelo é adequado
- Considere uma região mais próxima
- Verifica o tamanho da imagem enviada com cada pedido
Experimenta um valor de imgsz mais pequeno e compara a latência e a precisão resultantes para o teu modelo. Implementa numa região mais próxima de quem faz os pedidos para reduzir a latência de rede.
FAQ#
Por quanto tempo os dados são retidos?#
A API de métricas suporta janelas selecionáveis de 1 hora até 30 dias. O cartão de implementação mostra as 20 entradas de registo mais recentes; a API de registos pode devolver até 200 entradas por pedido e suporta paginação.
Posso monitorar vários endpoints juntos?#
Sim, a página de implantações mostra todos os endpoints com cartões de visão geral agregados. Use a visualização em tabela para comparar o desempenho entre as implantações.