YOLO Vision 2026:

Monitorização#

A Ultralytics Platform fornece monitorização para endpoints implementados. Acompanha as métricas dos pedidos, consulta os registos e verifica o estado de funcionamento com sondagem automática.

Cartões de visão geral e mapa-múndi da página de implementação da Ultralytics Platform

Painel de implementações#

A página Deploy na barra lateral funciona como painel de monitorização de todas as tuas implementações. Combina o mapa-múndi, as métricas de visão geral e a gestão de implementações numa única vista. Consulta Dedicated Endpoints para criar e gerir implementações.

graph TB
    subgraph Dashboard
        Map[World Map]:::proc --- Cards[Overview Cards]:::proc
        Cards --- List[Deployments List]:::decide
    end
    subgraph "Per Ready Deployment"
        Metrics[Metrics Row]:::out
        Health[Health Check]:::out
        Logs[Logs Tab]:::out
        Code[Code Tab]:::out
        Predict[Predict Tab]:::out
    end
    List --> Metrics
    List --> Health
    List --> Logs
    List --> Code
    List --> Predict

    classDef proc fill:#2196F3,color:#fff
    classDef decide fill:#FF9800,color:#fff
    classDef out fill:#9C27B0,color:#fff

Cartões de visão geral#

Os quatro cartões de resumo no topo da página mostram:

Quatro cartões de visão geral da página de implementação da Ultralytics Platform

MétricaDescrição
Total de pedidos (24 h)Pedidos em todos os endpoints
Implementações ativasEndpoints atualmente no estado Ready
Taxa de erros (24 h)Percentagem de respostas com estado 4xx ou 5xx, ponderada pelo volume de pedidos
Latência P95 (24 h)Média das latências do percentil 95 por hora, ponderada pelo volume

É comunicada a latência P95, em vez da latência mediana, porque as verificações de funcionamento demoram alguns milissegundos e, caso contrário, dominariam a representação da latência real de inferência.

Alerta da taxa de erros

O cartão da taxa de erros fica vermelho quando a taxa excede 5%. Consulta o separador Logs em implementações individuais para diagnosticar erros.

Mapa-múndi#

O mapa-múndi interativo mostra:

  • Marcadores de região para todas as 42 regiões disponíveis
  • Marcadores verdes para regiões com uma implementação pronta
  • Marcadores azuis animados para regiões com implementações ativas em curso
  • O tamanho do marcador varia consoante o estado da implementação e a latência

Clica em qualquer região para abrir a caixa de diálogo New Deployment. O mapa fica oculto em ecrãs pequenos.

Mapa-múndi da página de implementação da Ultralytics Platform com regiões implementadas

Lista de implementações#

Abaixo dos cartões de visão geral, a lista de implementações mostra todos os endpoints dos teus projetos. Usa o seletor do modo de visualização para alternar entre:

VistaDescrição
CartõesCartões detalhados com métricas, registos, código e separadores de previsão
CompactoGrelha de cartões mais pequenos (1–4 colunas) com métricas essenciais
TabelaDataTable com colunas ordenáveis: Nome, Região, Estado, Pedidos, P95, Erros
Atualizações em tempo real

O painel é atualizado automaticamente, com uma frequência maior enquanto as implementações estão num estado de transição (creating, deploying ou stopping). Clica no botão de atualização para obter atualizações imediatas.

Métricas por implementação#

Cada cartão de implementação (na vista de cartões) mostra métricas em tempo real. A linha de métricas, a verificação de funcionamento e os separadores Logs, Code e Predict descritos abaixo aparecem apenas enquanto a implementação estiver Ready:

Linha de métricas#

MétricaDescrição
PedidosContagem de pedidos nas últimas 24 horas
Latência P95Média das latências do percentil 95 por hora (24 h)
Taxa de errosPercentagem de respostas 4xx e 5xx, apresentada apenas quando é superior a 0

As métricas são atualizadas automaticamente. Os endpoints que ainda não processaram nenhum pedido mostram "Ainda sem tráfego" e as métricas só são recolhidas para implementações no estado Ready. No painel de implementações, as métricas são obtidas para as 20 implementações mais recentes.

Verificação de integridade#

As implementações em execução mostram um indicador de verificação de funcionamento:

IndicadorSignificado
Coração verdeSaudável — mostra a latência da resposta
Coração vermelhoNão saudável — mostra a mensagem de erro
Ícone giratórioVerificação de funcionamento em curso

As verificações de funcionamento são repetidas automaticamente enquanto o endpoint não está saudável e param assim que o endpoint responde. Clica no ícone de atualização para acionar manualmente uma verificação de funcionamento, que também funciona como forma de aquecer um endpoint reduzido a zero antes de enviar tráfego.

Cartão de implementação da Ultralytics Platform com verificação de funcionamento saudável e latência

Tolerância ao arranque a frio

A plataforma dá tempo adicional à verificação de funcionamento e repete as tentativas em caso de falhas de ligação transitórias, para que um endpoint reduzido a zero tenha tempo de iniciar. Se o cartão apresentar "A iniciar o serviço...", atualiza-o para detetar uma instância que tenha terminado o arranque entretanto.

Registos#

Cada cartão de implementação inclui um separador Logs para consultar as entradas de registo recentes:

Separador de registos do cartão de implementação da Ultralytics Platform com filtro de gravidade

Entradas de registo#

Cada entrada de registo mostra:

CampoDescrição
GravidadeBarra codificada por cores (ver abaixo)
Carimbo de data/horaHora do pedido (formato local)
MensagemConteúdo do registo
Informações HTTPCódigo de estado e latência (se aplicável)

Cada entrada inclui uma barra de gravidade codificada por cores:

NívelCorDescrição
DEBUGCinzentoMensagens de depuração
INFOAzulPedidos normais
WARNINGÂmbarProblemas não críticos
ERRORVermelhoPedidos falhados
CRITICALVermelhoFalhas críticas

A API aceita o conjunto completo de gravidades de registo como filtro separado por vírgulas: DEBUG, INFO, NOTICE, WARNING, ERROR, CRITICAL, ALERT e EMERGENCY.

A interface mostra as 20 entradas mais recentes e oculta as vazias. Por predefinição, a API devolve 50 entradas por pedido (máximo de 200) e retorna um nextPageToken para paginar mais para trás.

Fluxo de depuração

Ao investigar erros: primeiro clica em Errors para filtrar as entradas ERROR e WARNING e, em seguida, revê os carimbos de data/hora e os códigos de estado HTTP. Copia os registos para a área de transferência para os partilhares com a tua equipa.

Exemplos de código#

Cada cartão de implementação inclui um separador Code que mostra código de API pronto a utilizar, com o URL do endpoint preenchido. Para os proprietários do workspace, a chave de API associada à implementação é inserida, pronta para copiar e executar. Os não proprietários veem um marcador de posição YOUR_API_KEY:

import requests

# Deployment endpoint
url = "https://YOUR_DEPLOYMENT_URL.run.app/predict"

# Headers with your deployment API key
headers = {"Authorization": "Bearer YOUR_API_KEY"}

# Inference parameters
data = {"conf": 0.25, "iou": 0.7, "imgsz": 640}

# Send image for inference
with open("image.jpg", "rb") as f:
    response = requests.post(url, headers=headers, data=data, files={"file": f})

print(response.json())
Credenciais preenchidas automaticamente

Ao veres o separador Code na plataforma, o URL do endpoint e, para os proprietários do workspace, a chave de API associada à implementação são preenchidos automaticamente. Consulta Chaves de API para gerar uma chave.

Previsão da implementação#

O separador Predict em cada cartão de implementação fornece um painel de previsão integrado — a mesma interface do separador Predict do modelo, mas executando a inferência através do endpoint de implementação em vez do serviço partilhado. Isto é útil para testar um endpoint implementado diretamente a partir do navegador. Consulta Inferência para obter detalhes sobre os parâmetros e os formatos das respostas.

Endpoints da API#

Cada implementação é identificada pelo seu proprietário e nome, e cada rota requer uma chave de API. Consulta a referência da API para obter detalhes sobre a autenticação.

Métricas da implementação#

GET /api/deployments/{owner}/{deployment}/metrics?range=24h

SDK Python: client.deployments.metrics(owner, deployment, range="24h")

Devolve o payload completo de métricas de uma implementação: um bloco summary com o total de pedidos, a contagem e a taxa de erros e as latências média, P50, P95 e P99, além de matrizes timeSeries para pedidos, erros e latências P50 e P95, utilização de CPU e memória e contagem de instâncias.

ParâmetroTipoDescrição
rangestringIntervalo de tempo: 1h, 6h, 24h, 7d ou 30d (predefinição: 24h)
sparklineboolDevolve o resumo compacto do dashboard em vez do payload completo

Com sparkline=true, a resposta apresenta o formato compacto utilizado pelos cartões de implementação — 24 contagens horárias de pedidos, além do total de pedidos, da taxa de erros e da latência média. Esta é a chamada que é atualizada a cada 60 segundos.

Registos da implementação#

GET /api/deployments/{owner}/{deployment}/logs?limit=50&severity=ERROR,WARNING

SDK Python: client.deployments.logs(owner, deployment, limit=50, severity="ERROR,WARNING")

Devolve entradas de registo recentes com filtro de gravidade e paginação opcionais.

ParâmetroTipoDescrição
limitintNúmero máximo de entradas a devolver (predefinição: 50, máximo: 200)
severitystringFiltro de gravidade separado por vírgulas
pageTokenstringToken de paginação da resposta anterior

Estado da implementação#

GET /api/deployments/{owner}/{deployment}/health

SDK Python: client.deployments.health(owner, deployment)

Faz ping à implementação e devolve o respetivo estado de funcionamento com a latência de ida e volta medida:

{
    "healthy": true,
    "status": 200,
    "latencyMs": 142
}

Uma resposta de estado não saudável omite status quando não foi possível alcançar o endpoint, e adiciona uma mensagem error.

Visão geral do dashboard

Os números agregados na página Deploy não estão disponíveis como um único endpoint REST. Reprodu-los chamando a rota de métricas para cada implementação devolvida por GET /api/deployments/{owner} (client.deployments.list(owner)).

Otimização do desempenho#

Utiliza os dados de monitorização para otimizar as tuas implementações:

Se a latência for demasiado elevada:

  1. Verifica se o tamanho do modelo é adequado
  2. Considera uma região mais próxima
  3. Verifica o tamanho da imagem enviada com cada pedido
Reduzir a latência

Experimenta um valor imgsz menor e compara a latência e a precisão resultantes do teu modelo. Implementa numa região mais próxima dos autores das chamadas para reduzir a latência da rede.

Perguntas frequentes#

  • A API de métricas suporta janelas selecionáveis de 1 hora a 30 dias, com uma amostragem progressivamente menos granular à medida que a janela aumenta — intervalos de 1 minuto numa janela de 1 hora até intervalos de 4 horas numa janela de 30 dias. O cartão da implementação mostra as 20 entradas de registo mais recentes; a API de registos pode devolver até 200 entradas por pedido e suporta paginação.

    As métricas e os registos são retidos apenas enquanto a implementação existir, pelo que eliminar uma implementação também termina o acesso ao seu histórico. Exporta tudo o que precisares de conservar antes de eliminares um endpoint.

  • Sim, a página de implementações mostra todos os endpoints com cartões de visão geral agregada. Utiliza a vista de tabela para comparar o desempenho entre implementações.

  • Não. As métricas e as verificações de estado são recolhidas apenas para implementações no estado Ready. Um endpoint parado mantém o seu cartão e a janela de histórico, mas não mostra números em tempo real até ser iniciado novamente.

Comentários