YOLO Vision 2026:

Endpoints Dedicados#

A Ultralytics Platform permite a implementação de modelos YOLO em endpoints dedicados em 42 regiões globais. Cada endpoint é um serviço de locatário único com comportamento de escala para zero, um URL de endpoint exclusivo e monitoramento independente.

Ultralytics Platform Model Deploy Tab With Region Map And Table

Criar Endpoint#

A partir da guia Deploy#

Implemente um modelo a partir da sua guia Deploy:

  1. Navegue até seu modelo
  2. Clique na guia Deploy
  3. Analisa o mapa-múndi e a tabela de regiões, que está ordenada pela latência medida a partir da tua localização
  4. Clica em Deploy na linha da região que queres usar

O nome da implementação é gerado automaticamente a partir do nome do modelo e da cidade da região (por exemplo, yolo26n-iowa).

A partir da página Deployments#

Crie uma implementação a partir da página global Deploy na barra lateral:

  1. Clique em New Deployment
  2. Selecione um modelo no seletor de modelos
  3. Selecione uma região no mapa ou na tabela
  4. Analisa o nome de implementação gerado automaticamente e editável, bem como os padrões de recursos fixos
  5. Clique em Deploy Model

Ultralytics Platform New Deployment Dialog With Model Selector And Region Map

Ciclo de Vida de Implantação#

stateDiagram-v2
    [*] --> Creating: Deploy
    Creating --> Deploying: Container starting
    Deploying --> Ready: Health check passed
    Ready --> Stopping: Stop
    Stopping --> Stopped: Stopped
    Stopped --> Ready: Start
    Ready --> [*]: Delete
    Stopped --> [*]: Delete
    Creating --> Failed: Error
    Deploying --> Failed: Error
    Failed --> [*]: Delete

    classDef proc fill:#2196F3,color:#fff
    classDef out fill:#9C27B0,color:#fff
    classDef error fill:#F44336,color:#fff
    classDef extern fill:#607D8B,color:#fff
    class Creating,Deploying,Stopping proc
    class Ready out
    class Failed error
    class Stopped extern

Conecta Slack alerts para receber uma mensagem quando uma implantação estiver pronta ou falhar ao iniciar.

Seleção de Região#

Escolhe entre 42 regiões em todo o mundo. O mapa de regiões interativo e a tabela mostram:

  • Pinos de região: Codificados por cores por latência em um gradiente de verde para vermelho (regiões mais rápidas são mais verdes, regiões mais lentas são mais vermelhas)
  • Regiões implementadas: Destacadas com um selo "Deployed"
  • Regiões em implementação: Indicador de pulso animado
  • Destaque bidirecional: Passar o mouse sobre o mapa destaca a linha da tabela, e vice-versa

Ultralytics Platform Deploy Tab Region Latency Table Sorted By Latency A tabela de regiões no separador Deploy do modelo inclui:

ColunaDescrição
LocalizaçãoCidade e país com ícone de bandeira
ZonaIdentificador da região
LatênciaTempo de ping medido (mediana de 3 pings)
DistânciaDistância da sua localização em km
AçõesBotão Deploy ou selo de status "Deployed"
Caixa de Diálogo Nova Implementação

A caixa de diálogo New Deployment (a partir da página global Deploy) mostra uma tabela de regiões mais simples com apenas as colunas Localização, Latência e Selecionar.

Escolha com Sabedoria

Selecione a região mais próxima dos seus usuários para obter a menor latência. Use o botão Rescan para medir novamente a latência a partir da sua localização atual.

Regiões Disponíveis#

ZonaLocalização
us-central1Iowa, EUA
us-east1Carolina do Sul, EUA
us-east4Virgínia do Norte, EUA
us-east5Columbus, EUA
us-south1Dallas, EUA
us-west1Oregon, EUA
us-west2Los Angeles, EUA
us-west3Salt Lake City, EUA
us-west4Las Vegas, EUA
northamerica-northeast1Montreal, Canadá
northamerica-northeast2Toronto, Canadá
northamerica-south1Querétaro, México
southamerica-east1São Paulo, Brasil
southamerica-west1Santiago, Chile

Configuração de Endpoint#

Caixa de Diálogo Nova Implementação#

A caixa de diálogo New Deployment fornece:

ConfiguraçãoDescriçãoPredefinição
ModeloSelecione a partir de modelos concluídos-
RegiãoRegião da implantação-
Nome da ImplantaçãoGerado automaticamente, editável-
Núcleos de CPUPadrão fixo1
Memória (GB)Padrão fixo2

Ultralytics Platform New Deployment Dialog Fixed Resource Defaults O painel Resources desativado está marcado como Coming Soon e atualmente não pode ser expandido nem personalizado. As implementações utilizam 1 CPU, 2 GiB de memória, minInstances = 0 e maxInstances = 1.

Nomes Gerados Automaticamente

O nome da implantação é gerado automaticamente a partir do nome do modelo e da cidade da região (por exemplo, yolo26n-iowa). Se você implantar o mesmo modelo na mesma região novamente, um sufixo numérico será adicionado (por exemplo, yolo26n-iowa-2).

Guia Deploy (Implantação Rápida)#

Ao implantar a partir da guia Deploy do modelo, os endpoints são criados com recursos padrão (1 CPU, 2 GB de memória) com a escala para zero ativada. O nome da implantação é gerado automaticamente.

Gerenciar Endpoints#

Modos de Visualização#

A lista de implantações suporta três modos de visualização:

ModoDescrição
CartõesCartões de detalhes completos com logs, exemplos de código, painel de previsão
CompactoGrade de cartões menores com métricas principais
TabelaDataTable com colunas ordenáveis e pesquisa

Ultralytics Platform Deploy Tab Active Deployments Cards View

Cartão de Implantação (Visualização de Cartões)#

Cada cartão de implantação na visualização de cartões mostra:

  • Cabeçalho: Nome, bandeira da região, selo de status, botões de iniciar/parar/excluir
  • URL do Endpoint: URL copiável com link para a documentação da API
  • Métricas: Contagem de solicitações (24h), latência P95, taxa de erro
  • Verificação de integridade: Indicador de integridade ao vivo com latência e atualização manual
  • Guias: Logs, Code e Predict

A guia Logs mostra entradas de log recentes com filtragem de gravidade (Tudo / Erros). A guia Code mostra exemplos de código prontos para uso em Python, JavaScript e cURL com sua URL de endpoint real e chave de API. A guia Predict fornece um painel de previsão em linha para testes diretamente na implantação.

Status de Implantação#

StatusDescrição
CriandoA implantação está sendo configurada
ImplantandoO contêiner está iniciando
ProntoO endpoint está ativo e aceitando solicitações
ParandoO endpoint está sendo desligado
ParadoO endpoint está pausado e indisponível
FailedA implantação falhou (consulte a mensagem de erro)

URL do Endpoint#

Cada endpoint possui uma URL única, por exemplo:

https://predict-abc123.run.app

Ultralytics Platform Deployment Card Endpoint Url With Copy Button Clica no botão de copiar para copiar o URL. Clica no ícone de documentação para ver a documentação da API gerada automaticamente para o endpoint.

Gerenciamento de Ciclo de Vida#

Controle o estado do seu endpoint:

graph LR
    R[Ready]:::out -->|Stop| S[Stopped]:::extern
    S -->|Start| R
    R -->|Delete| D[Deleted]:::error
    S -->|Delete| D

    classDef out fill:#9C27B0,color:#fff
    classDef error fill:#F44336,color:#fff
    classDef extern fill:#607D8B,color:#fff
AçãoDescrição
IniciarRetomar um endpoint parado
PararPausar o endpoint
DeleteRemover permanentemente o endpoint

Parar Endpoint#

Para um endpoint quando não quiseres que ele aceite pedidos:

  1. Clique no ícone de pausa no cartão de implantação
  2. O status do endpoint muda para "Parando" e depois para "Parado"

Endpoints parados:

  • Não aceitam solicitações
  • Podem ser reiniciados a qualquer momento

Excluir Endpoint#

Remover permanentemente um endpoint:

  1. Clique no ícone de exclusão (lixeira) no cartão de implantação
  2. Confirme a exclusão na caixa de diálogo
Ação Permanente

A exclusão é imediata e permanente. Você sempre pode criar um novo endpoint.

Usando Endpoints#

Autenticação#

Cada implantação é criada com uma chave de API da sua conta. Inclua-a nas solicitações:

Authorization: Bearer YOUR_API_KEY

O prefixo da chave de API é exibido no rodapé do cartão de implantação para identificação. Gere chaves a partir de API Keys.

Pedidos Diretos de Endpoint#

Envia pedidos de produção diretamente para o URL apresentado no cartão de implementação. Estes pedidos não passam pelo limitador de taxa da API da Platform. O endpoint executa atualmente uma instância com os recursos fixos descritos acima.

Exemplo de solicitação#

import requests

# Deployment endpoint
url = "https://predict-abc123.run.app/predict"

# Headers with your deployment API key
headers = {"Authorization": "Bearer YOUR_API_KEY"}

# Inference parameters
data = {"conf": 0.25, "iou": 0.7, "imgsz": 640}

# Send image for inference
with open("image.jpg", "rb") as f:
    response = requests.post(url, headers=headers, data=data, files={"file": f})

print(response.json())

Parâmetros de solicitação#

ParâmetroTipoPredefiniçãoIntervaloDescrição
filearquivo--Ficheiro de imagem ou vídeo (obrigatório a menos que source esteja definido)
conffloat0.250.01 – 1.0Limite mínimo de confiança
ioufloat0,70.0 – 0.95Limite de IoU do NMS
imgszint64032 – 1280Tamanho da imagem de entrada em pixels
normalizeboolfalse-Retornar coordenadas de caixa delimitadora como 0 – 1
decimalsint50 – 10Precisão decimal para valores de coordenadas
sourcestring--URL da imagem ou string base64 (alternativa para file)
Inferência de vídeo

Endpoints dedicados aceitam tanto imagens quanto vídeos via parâmetro file.

  • Formatos de imagem (até 100 MB): AVIF, BMP, DNG, HEIC, JP2, JPEG, JPG, MPO, PNG, TIF, TIFF, WEBP
  • Formatos de vídeo (até 100 MB): ASF, AVI, GIF, M4V, MKV, MOV, MP4, MPEG, MPG, TS, WEBM, WMV

Cada quadro de vídeo é processado individualmente e os resultados são retornados por quadro. Você também pode passar uma URL pública de imagem ou uma imagem codificada em base64 via parâmetro source em vez de file.

Formato de Resposta#

Igual à inferência compartilhada com campos específicos da tarefa.

FAQ#

Quantos endpoints posso criar?#

Os limites de endpoint dependem do plano:

  • Free: Até 3 implantações
  • Pro: Até 10 implantações
  • Enterprise: Implantações ilimitadas

Cada modelo ainda pode ser implantado em várias regiões dentro da cota do seu plano.

Posso alterar a região após a implantação?#

Não, as regiões são fixas. Para alterar as regiões:

  1. Exclua o endpoint existente
  2. Crie um novo endpoint na região desejada

Como lido com a implantação em várias regiões?#

Para cobertura global:

  1. Implante em várias regiões
  2. Use um balanceador de carga ou roteamento DNS
  3. Encaminhe os usuários para o endpoint mais próximo

Qual é o tempo de cold start?#

O tempo de arranque a frio depende do modelo e de o endpoint ter reduzido a escala para zero. O pedido de verificação de estado da Platform permite até 55 segundos para que um endpoint ocioso tenha tempo de iniciar.

Cada implementação utiliza atualmente o URL de endpoint gerado apresentado no respetivo cartão de implementação.

Comentários