YOLO Vision 2026:

Monitoramento#

A Ultralytics Platform fornece monitoramento para endpoints implantados. Acompanha métricas de requisições, visualiza logs e verifica o status de integridade com polling automático.

Ultralytics Platform Deploy Page Overview Cards And World Map

Painel de Implantações#

A página Deploy na barra lateral serve como painel de monitoramento para todas as suas implantações. Ela combina o mapa-múndi, métricas de visão geral e gerenciamento de implantação em uma única visualização. Consulte Endpoints Dedicados para criar e gerenciar implantações.

graph TB
    subgraph Dashboard
        Map[World Map]:::proc --- Cards[Overview Cards]:::proc
        Cards --- List[Deployments List]:::decide
    end
    subgraph "Per Deployment"
        Metrics[Metrics Row]:::out
        Health[Health Check]:::out
        Logs[Logs Tab]:::out
        Code[Code Tab]:::out
        Predict[Predict Tab]:::out
    end
    List --> Metrics
    List --> Health
    List --> Logs
    List --> Code
    List --> Predict

    classDef proc fill:#2196F3,color:#fff
    classDef decide fill:#FF9800,color:#fff
    classDef out fill:#9C27B0,color:#fff

Cartões de Visão Geral#

Quatro cartões de resumo na parte superior da página mostram:

Ultralytics Platform Deploy Page Four Overview Cards

MétricaDescrição
Total de Solicitações (24h)Solicitações em todos os endpoints
Implantações AtivasEndpoints em execução no momento
Taxa de Erro (24h)Porcentagem de solicitações com falha
Latência P95 (24h)Tempo de resposta no percentil 95
Alerta de Taxa de Erro

O cartão de taxa de erro fica destacado em vermelho quando a taxa excede 5%. Verifique a aba Logs em cada implantação para diagnosticar erros.

Mapa-Múndi#

O mapa-múndi interativo mostra:

  • Fixadores de região para todas as 42 regiões disponíveis
  • Marcadores verdes para regiões implantadas
  • Marcadores azuis animados para regiões com implantações ativas em andamento
  • O tamanho do marcador varia conforme o status da implantação e a latência

Ultralytics Platform Deploy Page World Map With Deployed Regions

Lista de Implantações#

Abaixo dos cartões de visão geral, a lista de implantações mostra todos os endpoints em seus projetos. Use o botão de modo de visualização para alternar entre:

VerDescrição
CartõesCartões de detalhes completos com abas de métricas, logs, código e predição
CompactoGrade de cartões menores (1-4 colunas) com métricas principais
TabelaTabela de dados com colunas classificáveis: Nome, Região, Status, Solicitações, P95, Erros
Atualizações em Tempo Real

O painel consulta o estado das implementações a cada 15 segundos para obter atualizações. Quando as implementações estão num estado de transição (creating, deploying ou stopping), as consultas aumentam para cada 3 segundos. As métricas por implementação são atualizadas a cada 60 segundos. Clica no botão de atualizar para obter atualizações imediatas.

Métricas por Implantação#

Cada cartão de implantação (na visualização de cartões) mostra métricas em tempo real:

Linha de Métricas#

MétricaDescrição
SolicitaçõesContagem de solicitações (24h) com ícone
Latência P95Tempo de resposta no percentil 95
Taxa de ErroPorcentagem de solicitações com falha

As métricas são buscadas no endpoint da API de sparkline e atualizadas a cada 60 segundos.

Verificação de Saúde#

As implantações em execução mostram um indicador de verificação de integridade:

IndicadorSignificado
Coração verdeSaudável — mostra a latência de resposta
Coração vermelhoNão saudável — mostra a mensagem de erro
Ícone giratórioVerificação de integridade em andamento

As verificações de integridade tentam novamente automaticamente a cada 20 segundos quando não estão saudáveis. Clique no ícone de atualização para acionar manualmente uma verificação de integridade. A verificação de integridade usa um tempo limite de 55 segundos para acomodar cold starts em endpoints com escala para zero.

Ultralytics Platform Deployment Card Health Check Healthy With Latency

Tolerância a Cold Start

O pedido de verificação de estado permite até 55 segundos para que um endpoint dimensionado para zero tenha tempo de iniciar.

Logs#

Cada cartão de implantação inclui uma aba Logs para visualizar entradas de log recentes:

Ultralytics Platform Deployment Card Logs Tab With Severity Filter

Entradas de Log#

Cada entrada de log mostra:

CampoDescrição
SeveridadeBarra codificada por cores (veja abaixo)
Carimbo de data/horaHora da solicitação (formato local)
MensagemConteúdo do log
Informações HTTPCódigo de status e latência (se aplicável)

Filtre logs por severidade usando os botões de filtro:

NívelCorDescrição
DEBUGCinzaMensagens de depuração
INFOAzulSolicitações normais
WARNINGAmareloProblemas não críticos
ERRORVermelhoSolicitações com falha
CRITICALVermelho EscuroFalhas críticas

A interface mostra as 20 entradas mais recentes. A API define como padrão 50 entradas por solicitação (máximo de 200).

Fluxo de Trabalho de Depuração

Ao investigar erros: primeiro clique em Erros para filtrar para entradas ERROR e WARNING, depois revise os carimbos de data/hora e os códigos de status HTTP. Copie os logs para a área de transferência para compartilhar com sua equipe.

Exemplos de Código#

Cada cartão de implantação inclui uma aba Code mostrando código de API pronto para uso com seu URL de endpoint real e chave de API:

import requests

# Deployment endpoint
url = "https://predict-abc123.run.app/predict"

# Headers with your deployment API key
headers = {"Authorization": "Bearer YOUR_API_KEY"}

# Inference parameters
data = {"conf": 0.25, "iou": 0.7, "imgsz": 640}

# Send image for inference
with open("image.jpg", "rb") as f:
    response = requests.post(url, headers=headers, data=data, files={"file": f})

print(response.json())
Credenciais Preenchidas Automaticamente

Ao visualizar a aba Code na plataforma, seu URL de endpoint real e chave de API são preenchidos automaticamente. Copie o código e execute-o diretamente. Consulte Chaves de API para gerar uma chave.

Previsão de Implementação#

A guia Predict em cada cartão de implantação fornece um painel de predição integrado — a mesma interface da guia Predict do modelo, mas executando a inferência através do endpoint de implantação em vez do serviço compartilhado. Isso é útil para testar um endpoint implantado diretamente do navegador. Veja Inference para detalhes de parâmetros e formatos de resposta.

Endpoints de API#

Visão geral de monitoramento#

GET /api/monitoring

Retorna métricas agregadas para todas as implantações de propriedade do usuário autenticado. Ciente do workspace através do parâmetro de consulta opcional owner.

Métricas de implantação#

GET /api/deployments/{deploymentId}/metrics?sparkline=true&range=24h

Retorna dados de sparkline e métricas de resumo para uma implantação específica. Intervalo de atualização: 60 segundos.

ParâmetroTipoDescrição
sparklineboolIncluir dados de sparkline
rangestringIntervalo de tempo: 1h, 6h, 24h, 7d ou 30d

Logs de implantação#

GET /api/deployments/{deploymentId}/logs?limit=50&severity=ERROR,WARNING

Retorna entradas de log recentes com filtro de severidade e paginação opcionais.

ParâmetroTipoDescrição
limitintNúmero máximo de entradas para retornar (padrão: 50, máximo: 200)
severitystringFiltro de severidade separado por vírgula
pageTokenstringToken de paginação da resposta anterior

Saúde da implantação#

GET /api/deployments/{deploymentId}/health

Retorna o status da verificação de saúde com latência de resposta.

{
    "healthy": true,
    "status": 200,
    "latencyMs": 142,
    "serverTiming": { "db": 8, "ping": 142, "total": 150 }
}

Otimização de Desempenho#

Use dados de monitoramento para otimizar suas implantações:

Se a latência estiver muito alta:

  1. Verifica se o tamanho do modelo é adequado
  2. Considere uma região mais próxima
  3. Verifica o tamanho da imagem enviada com cada pedido
Reduzindo a latência

Experimenta um valor de imgsz mais pequeno e compara a latência e a precisão resultantes para o teu modelo. Implementa numa região mais próxima de quem faz os pedidos para reduzir a latência de rede.

FAQ#

Por quanto tempo os dados são retidos?#

A API de métricas suporta janelas selecionáveis de 1 hora até 30 dias. O cartão de implementação mostra as 20 entradas de registo mais recentes; a API de registos pode devolver até 200 entradas por pedido e suporta paginação.

Posso monitorar vários endpoints juntos?#

Sim, a página de implantações mostra todos os endpoints com cartões de visão geral agregados. Use a visualização em tabela para comparar o desempenho entre as implantações.

Comentários