YOLO Vision 2026:

Monitoramento#

Ultralytics Platform fornece monitoramento para endpoints implantados. Rastreie métricas de requisição, visualize logs e verifique o status de integridade com polling automático.

Ultralytics Platform Deploy Page Overview Cards And World Map

Painel de Implantações#

A página Deploy na barra lateral serve como o painel de monitoramento para todas as tuas implantações. Ela combina o mapa-múndi, métricas de visão geral e gerenciamento de implantações em uma única visualização. Consulte Dedicated Endpoints para criar e gerenciar implantações.

graph TB
    subgraph Dashboard
        Map[World Map]:::proc --- Cards[Overview Cards]:::proc
        Cards --- List[Deployments List]:::decide
    end
    subgraph "Per Ready Deployment"
        Metrics[Metrics Row]:::out
        Health[Health Check]:::out
        Logs[Logs Tab]:::out
        Code[Code Tab]:::out
        Predict[Predict Tab]:::out
    end
    List --> Metrics
    List --> Health
    List --> Logs
    List --> Code
    List --> Predict

    classDef proc fill:#2196F3,color:#fff
    classDef decide fill:#FF9800,color:#fff
    classDef out fill:#9C27B0,color:#fff

Cartões de Visão Geral#

Quatro cartões de resumo na parte superior da página mostram:

Ultralytics Platform Deploy Page Four Overview Cards

MétricaDescrição
Total de Solicitações (24h)Solicitações em todos os endpoints
Implantações AtivasEndpoints atualmente no estado Ready
Taxa de Erro (24h)Parcela de respostas com um status 4xx ou 5xx, ponderada pelo volume de solicitações
Latência P95 (24h)Média das latências horárias no 95º percentil, ponderada pelo volume

O P95 em vez da latência mediana é relatado porque as verificações de integridade retornam em alguns milissegundos e, caso contrário, dominariam o panorama da latência de inferência real.

Alerta de Taxa de Erro

O cartão de taxa de erro fica destacado em vermelho quando a taxa excede 5%. Verifique a aba Logs em implantações individuais para diagnosticar erros.

Mapa-Múndi#

O mapa-múndi interativo mostra:

  • Fixadores de região para todas as 42 regiões disponíveis
  • Pinos verdes para regiões com um deployment pronto
  • Marcadores azuis animados para regiões com implantações ativas em andamento
  • O tamanho do marcador varia conforme o status da implantação e a latência

Clica em qualquer região para abrir o diálogo New Deployment. O mapa fica oculto em telas pequenas.

Ultralytics Platform Deploy Page World Map With Deployed Regions

Lista de Implantações#

Abaixo dos cartões de visão geral, a lista de implantações mostra todos os endpoints em seus projetos. Use o botão de modo de visualização para alternar entre:

VerDescrição
CartõesCartões de detalhes completos com abas de métricas, logs, código e predição
CompactoGrade de cartões menores (1-4 colunas) com métricas principais
TabelaTabela de dados com colunas classificáveis: Nome, Região, Status, Solicitações, P95, Erros
Atualizações em Tempo Real

O painel é atualizado automaticamente, atualizando mais rapidamente enquanto os deployments estão em um estado de transição (creating, deploying ou stopping). Clica no botão de atualizar para obter atualizações imediatas.

Métricas por Implantação#

Cada cartão de implantação (na vista de cartões) mostra métricas em tempo real. A linha de métricas, a verificação de integridade e as abas Logs, Code e Predict descritas abaixo aparecem apenas enquanto a implantação estiver Pronta:

Linha de Métricas#

MétricaDescrição
SolicitaçõesContagem de solicitações nas últimas 24 horas
Latência P95Média das latências horárias no 95º percentil (24h)
Taxa de ErroParcela de respostas 4xx e 5xx, exibida apenas quando acima de 0

As métricas são atualizadas automaticamente. Endpoints que não serviram nenhuma solicitação mostram "No traffic yet", e as métricas são coletadas apenas para deployments no estado Ready. No painel de deployments, as métricas são buscadas para os 20 deployments mais recentes.

Verificação de Saúde#

As implantações em execução mostram um indicador de verificação de integridade:

IndicadorSignificado
Coração verdeSaudável — mostra a latência de resposta
Coração vermelhoNão saudável — mostra a mensagem de erro
Ícone giratórioVerificação de integridade em andamento

As verificações de integridade tentam novamente de forma automática enquanto estiverem com problemas e param assim que o endpoint responder. Clica no ícone de atualizar para acionar manualmente uma verificação de integridade, que também serve como uma forma de aquecer um endpoint dimensionado para zero antes de enviar tráfego.

Ultralytics Platform Deployment Card Health Check Healthy With Latency

Tolerância a Cold Start

A plataforma dá tempo extra para a verificação de integridade e tenta novamente falhas de conexão transitórias, para que um endpoint dimensionado para zero tenha tempo de iniciar. Se o cartão relatar "Service starting up...", atualiza-o para apanhar uma instância que terminou de inicializar entretanto.

Logs#

Cada cartão de implantação inclui uma aba Logs para visualizar entradas de log recentes:

Ultralytics Platform Deployment Card Logs Tab With Severity Filter

Entradas de Log#

Cada entrada de log mostra:

CampoDescrição
SeveridadeBarra codificada por cores (veja abaixo)
Carimbo de data/horaHora da solicitação (formato local)
MensagemConteúdo do log
Informações HTTPCódigo de status e latência (se aplicável)

Cada entrada possui uma barra de gravidade colorida:

NívelCorDescrição
DEBUGCinzaMensagens de depuração
INFOAzulSolicitações normais
WARNINGÂmbarProblemas não críticos
ERRORVermelhoSolicitações com falha
CRITICALVermelhoFalhas críticas

A API aceita o conjunto completo de gravidades de logs como um filtro separado por vírgulas: DEBUG, INFO, NOTICE, WARNING, ERROR, CRITICAL, ALERT e EMERGENCY.

A IU mostra as 20 entradas mais recentes e oculta as vazias. A API assume como padrão 50 entradas por solicitação (máx. 200) e retorna um nextPageToken para paginação mais retroativa.

Fluxo de Trabalho de Depuração

Ao investigar erros: primeiro clique em Erros para filtrar para entradas ERROR e WARNING, depois revise os carimbos de data/hora e os códigos de status HTTP. Copie os logs para a área de transferência para compartilhar com sua equipe.

Exemplos de Código#

Cada cartão de deployment inclui uma aba Code que mostra código de API pronto a usar com o URL do endpoint preenchido. Para os proprietários de espaços de trabalho, a chave de API vinculada do deployment é inserida, pronta para copiar e executar. Os não proprietários veem um espaço reservado YOUR_API_KEY:

import requests

# Deployment endpoint
url = "https://YOUR_DEPLOYMENT_URL.run.app/predict"

# Headers with your deployment API key
headers = {"Authorization": "Bearer YOUR_API_KEY"}

# Inference parameters
data = {"conf": 0.25, "iou": 0.7, "imgsz": 640}

# Send image for inference
with open("image.jpg", "rb") as f:
    response = requests.post(url, headers=headers, data=data, files={"file": f})

print(response.json())
Credenciais Preenchidas Automaticamente

Ao visualizar a aba Code na plataforma, o URL do endpoint e, para os proprietários de espaços de trabalho, a chave de API vinculada do deployment são preenchidas para ti. Consulta API Keys para gerar uma chave.

Previsão de Implementação#

A aba Predict em cada cartão de implantação fornece um painel de previsão embutido — a mesma interface da aba Predict do modelo, mas executando inferência através do endpoint de implantação em vez do serviço compartilhado. Isso é útil para testar um endpoint implantado diretamente a partir do navegador. Consulte Inference para detalhes de parâmetros e formatos de resposta.

Endpoints de API#

Cada deployment é endereçado pelo seu proprietário e nome de deployment, e cada rota requer uma chave de API. Consulta a referência da API para obter detalhes de autenticação.

Métricas de implantação#

GET /api/deployments/{owner}/{deployment}/metrics?range=24h

SDK Python: client.deployments.metrics(owner, deployment, range="24h")

Retorna o payload completo de métricas para um deployment: um bloco summary com o total de solicitações, contagem e taxa de erros, e latência média, P50, P95 e P99, além de arrays timeSeries para solicitações, erros, latência P50 e P95, utilização de CPU e memória, e contagem de instâncias.

ParâmetroTipoDescrição
rangestringIntervalo de tempo: 1h, 6h, 24h, 7d ou 30d (padrão 24h)
sparklineboolRetornar o resumo compacto do painel em vez do payload completo

Com sparkline=true, a resposta é a forma compacta que os cartões de deployment utilizam — 24 contagens de solicitações horárias mais o total de solicitações, taxa de erro e latência média. Esta é a chamada que é atualizada a cada 60 segundos.

Logs de implantação#

GET /api/deployments/{owner}/{deployment}/logs?limit=50&severity=ERROR,WARNING

SDK Python: client.deployments.logs(owner, deployment, limit=50, severity="ERROR,WARNING")

Retorna entradas de log recentes com filtro de severidade e paginação opcionais.

ParâmetroTipoDescrição
limitintNúmero máximo de entradas para retornar (padrão: 50, máximo: 200)
severitystringFiltro de severidade separado por vírgula
pageTokenstringToken de paginação da resposta anterior

Saúde da implantação#

GET /api/deployments/{owner}/{deployment}/health

SDK Python: client.deployments.health(owner, deployment)

Faz ping no deployment e retorna o respetivo status de integridade com a latência de ida e volta medida:

{
    "healthy": true,
    "status": 200,
    "latencyMs": 142
}

Uma resposta com problemas omite status quando o endpoint não pôde ser alcançado de todo, e adiciona uma mensagem error.

Visão Geral do Painel

Os números agregados na página Deploy não estão disponíveis como um único endpoint REST. Reproduze-os chamando a rota de métricas para cada implantação retornada por GET /api/deployments/{owner} (client.deployments.list(owner)).

Otimização de Desempenho#

Use dados de monitoramento para otimizar suas implantações:

Se a latência estiver muito alta:

  1. Verifica se o tamanho do modelo é adequado
  2. Considere uma região mais próxima
  3. Verifica o tamanho da imagem enviada com cada pedido
Reduzindo a latência

Tente um valor menor de imgsz e compare a latência e a precisão resultantes para o teu modelo. Implante em uma região mais próxima dos chamadores para reduzir a latência de rede.

FAQ#

  • A API de métricas suporta janelas selecionáveis de 1 hora até 30 dias, amostradas de forma mais grosseira à medida que a janela cresce — blocos de 1 minuto ao longo de 1 hora até blocos de 4 horas ao longo de 30 dias. O cartão de deployment mostra as 20 entradas de log mais recentes; a API de logs pode retornar até 200 entradas por solicitação e suporta paginação.

    As métricas e os logs são retidos apenas enquanto o deployment existir, pelo que eliminar um deployment também encerra o acesso ao seu histórico. Exporta tudo o que precisas de manter antes de eliminar um endpoint.

  • Sim, a página de implantações mostra todos os endpoints com cartões de visão geral agregados. Use a visualização em tabela para comparar o desempenho entre as implantações.

  • Não. As métricas e as verificações de integridade são coletadas apenas para deployments no estado Ready. Um endpoint parado mantém o seu cartão e janela de histórico, mas não mostra números ao vivo até o iniciares novamente.

Comentários