YOLO Vision 2026:

Puntos de conexión dedicados#

Ultralytics Platform permite el despliegue de modelos YOLO en endpoints dedicados en 42 regiones globales. Cada endpoint es un servicio de inquilino único con comportamiento de escalado a cero, una URL de endpoint única y monitorización independiente.

Ultralytics Platform Model Deploy Tab With Region Map And Table

Crear endpoint#

Desde la pestaña de despliegue#

Despliega un modelo desde su pestaña Deploy:

  1. Navega hasta tu modelo
  2. Haz clic en la pestaña Deploy
  3. Revisa el mapamundi y la tabla de regiones, que está ordenada por la latencia medida desde tu ubicación
  4. Haz clic en Deploy en la fila de la región que quieras usar

El nombre del despliegue se genera automáticamente a partir del nombre del modelo y la ciudad de la región (p. ej., yolo26n-iowa).

Desde la página de despliegues#

Crea un despliegue desde la página global Deploy en la barra lateral:

  1. Haz clic en New Deployment
  2. Selecciona un modelo desde el selector de modelos
  3. Selecciona una región desde el mapa o la tabla
  4. Revisa el nombre de despliegue editable y generado automáticamente, y los valores predeterminados de recursos fijos
  5. Haz clic en Deploy Model

Ultralytics Platform New Deployment Dialog With Model Selector And Region Map

Ciclo de vida del despliegue#

stateDiagram-v2
    [*] --> Creating: Deploy
    Creating --> Deploying: Container starting
    Deploying --> Ready: Health check passed
    Ready --> Stopping: Stop
    Stopping --> Stopped: Stopped
    Stopped --> Ready: Start
    Ready --> [*]: Delete
    Stopped --> [*]: Delete
    Creating --> Failed: Error
    Deploying --> Failed: Error
    Failed --> [*]: Delete

    classDef proc fill:#2196F3,color:#fff
    classDef out fill:#9C27B0,color:#fff
    classDef error fill:#F44336,color:#fff
    classDef extern fill:#607D8B,color:#fff
    class Creating,Deploying,Stopping proc
    class Ready out
    class Failed error
    class Stopped extern

Conecta alertas de Slack para recibir un mensaje cuando un despliegue esté listo o falle al iniciarse.

Selección de región#

Elige entre 42 regiones en todo el mundo. El mapa de regiones interactivo y la tabla muestran:

  • Marcadores de región: Codificados por colores según la latencia en un degradado de verde a rojo (las regiones más rápidas son más verdes, las más lentas son más rojas)
  • Regiones desplegadas: Resaltadas con una insignia de "Deployed"
  • Regiones en despliegue: Indicador de pulso animado
  • Resaltado bidireccional: Pasar el cursor sobre el mapa resalta la fila de la tabla y viceversa

Ultralytics Platform Deploy Tab Region Latency Table Sorted By Latency La tabla de regiones en la pestaña Deploy del modelo incluye:

ColumnaDescripción
UbicaciónCiudad y país con icono de bandera
ZonaIdentificador de la región
LatenciaTiempo de ping medido (mediana de 3 pings)
DistanciaDistancia desde tu ubicación en km
AccionesBotón de desplegar o insignia de estado "Deployed"
Diálogo de nuevo despliegue

El diálogo New Deployment (desde la página global Deploy) muestra una tabla de regiones más sencilla con solo las columnas de ubicación, latencia y selección.

Elige con cuidado

Selecciona la región más cercana a tus usuarios para obtener la menor latencia. Usa el botón Rescan para volver a medir la latencia desde tu ubicación actual.

Regiones disponibles#

ZonaUbicación
us-central1Iowa, EE. UU.
us-east1Carolina del Sur, EE. UU.
us-east4Virginia del Norte, EE. UU.
us-east5Columbus, EE. UU.
us-south1Dallas, EE. UU.
us-west1Oregón, EE. UU.
us-west2Los Ángeles, EE. UU.
us-west3Salt Lake City, EE. UU.
us-west4Las Vegas, EE. UU.
northamerica-northeast1Montreal, Canadá
northamerica-northeast2Toronto, Canadá
northamerica-south1Querétaro, México
southamerica-east1São Paulo, Brasil
southamerica-west1Santiago, Chile

Configuración del Endpoint#

Diálogo de nuevo despliegue#

El cuadro de diálogo New Deployment ofrece:

ConfiguraciónDescripciónPredeterminado
ModeloSelecciona entre modelos finalizados-
RegiónRegión del despliegue-
Nombre de la implementaciónGenerado automáticamente, editable-
Núcleos de CPUPredeterminado fijo1
Memoria (GB)Predeterminado fijo2

Ultralytics Platform New Deployment Dialog Fixed Resource Defaults El panel desactivado Resources está marcado como Coming Soon y actualmente no se puede expandir ni personalizar. Los despliegues usan 1 CPU, 2 GiB de memoria, minInstances = 0 y maxInstances = 1.

Nombres generados automáticamente

El nombre de la implementación se genera automáticamente a partir del nombre del modelo y la ciudad de la región (por ejemplo, yolo26n-iowa). Si vuelves a implementar el mismo modelo en la misma región, se añade un sufijo numérico (por ejemplo, yolo26n-iowa-2).

Pestaña Deploy (Implementación rápida)#

Al implementar desde la pestaña Deploy del modelo, los endpoints se crean con recursos predeterminados (1 CPU, 2 GB de memoria) con la función de escala a cero activada. El nombre de la implementación se genera automáticamente.

Gestionar endpoints#

Modos de visualización#

La lista de implementaciones admite tres modos de visualización:

ModoDescripción
TarjetasTarjetas de detalles completos con registros, ejemplos de código y panel de predicción
CompactoCuadrícula de tarjetas más pequeñas con métricas clave
TablaDataTable con columnas ordenables y búsqueda

Ultralytics Platform Deploy Tab Active Deployments Cards View

Tarjeta de implementación (Vista de tarjetas)#

Cada tarjeta de implementación en la vista de tarjetas muestra:

  • Encabezado: Nombre, bandera de la región, distintivo de estado, botones de iniciar/detener/eliminar
  • URL del endpoint: URL que se puede copiar con enlace a la documentación de la API
  • Métricas: Número de solicitudes (24h), latencia P95, tasa de errores
  • Verificación de estado: Indicador de estado en tiempo real con latencia y actualización manual
  • Pestañas: Logs, Code y Predict

La pestaña Logs muestra las entradas de registro recientes con filtrado por gravedad (Todos / Errores). La pestaña Code muestra ejemplos de código listos para usar en Python, JavaScript y cURL con tu URL de endpoint real y tu clave de API. La pestaña Predict proporciona un panel de predicción integrado para realizar pruebas directamente en la implementación.

Estados de implementación#

EstadoDescripción
CreandoLa implementación se está configurando
ImplementandoEl contenedor se está iniciando
ListoEl endpoint está activo y aceptando solicitudes
DeteniendoEl endpoint se está apagando
DetenidoEl endpoint está pausado y no está disponible
FailedLa implementación falló (consulta el mensaje de error)

URL del endpoint#

Cada endpoint tiene una URL única, por ejemplo:

https://predict-abc123.run.app

Ultralytics Platform Deployment Card Endpoint Url With Copy Button Haz clic en el botón de copiar para copiar la URL. Haz clic en el icono de documentos para ver la documentación de la API generada automáticamente para el endpoint.

Gestión del ciclo de vida#

Controla el estado de tu endpoint:

graph LR
    R[Ready]:::out -->|Stop| S[Stopped]:::extern
    S -->|Start| R
    R -->|Delete| D[Deleted]:::error
    S -->|Delete| D

    classDef out fill:#9C27B0,color:#fff
    classDef error fill:#F44336,color:#fff
    classDef extern fill:#607D8B,color:#fff
AcciónDescripción
IniciarReanuda un endpoint detenido
DetenerPausa el endpoint
EliminarElimina permanentemente el endpoint

Detener endpoint#

Detén un endpoint cuando no quieras que acepte solicitudes:

  1. Haz clic en el icono de pausa en la tarjeta de implementación
  2. El estado del endpoint cambia a "Deteniendo" y luego a "Detenido"

Endpoints detenidos:

  • No aceptan solicitudes
  • Se pueden reiniciar en cualquier momento

Eliminar endpoint#

Elimina permanentemente un endpoint:

  1. Haz clic en el icono de eliminar (papelera) en la tarjeta de implementación
  2. Confirma la eliminación en el cuadro de diálogo
Acción permanente

La eliminación es inmediata y permanente. Siempre puedes crear un nuevo endpoint.

Uso de endpoints#

Autenticación#

Cada implementación se crea con una clave de API de tu cuenta. Inclúyela en las solicitudes:

Authorization: Bearer YOUR_API_KEY

El prefijo de la clave de API se muestra en el pie de página de la tarjeta de implementación para su identificación. Genera claves desde API Keys.

Solicitudes directas a endpoints#

Envía solicitudes de producción directamente a la URL que se muestra en la tarjeta de despliegue. Estas solicitudes no pasan por el limitador de tasa de la API de Platform. El endpoint ejecuta actualmente una instancia con los recursos fijos descritos anteriormente.

Ejemplo de solicitud#

import requests

# Deployment endpoint
url = "https://predict-abc123.run.app/predict"

# Headers with your deployment API key
headers = {"Authorization": "Bearer YOUR_API_KEY"}

# Inference parameters
data = {"conf": 0.25, "iou": 0.7, "imgsz": 640}

# Send image for inference
with open("image.jpg", "rb") as f:
    response = requests.post(url, headers=headers, data=data, files={"file": f})

print(response.json())

Parámetros de petición#

ParámetroTipoPredeterminadoRangoDescripción
filearchivo--Archivo de imagen o vídeo (obligatorio a menos que se establezca source)
conffloat0.250.01 – 1.0Umbral de confianza mínimo
ioufloat0.70.0 – 0.95Umbral de IoU para NMS
imgszentero64032 – 1280Tamaño de la imagen de entrada en píxeles
normalizeboolfalse-Devuelve las coordenadas del bounding box entre 0 y 1
decimalsentero50 – 10Precisión decimal para los valores de las coordenadas
sourcecadena--URL de imagen o cadena base64 (alternativa a file)
Inferencia de vídeo

Los endpoints dedicados aceptan tanto imágenes como vídeos a través del parámetro file.

  • Formatos de imagen (hasta 100 MB): AVIF, BMP, DNG, HEIC, JP2, JPEG, JPG, MPO, PNG, TIF, TIFF, WEBP
  • Formatos de vídeo (hasta 100 MB): ASF, AVI, GIF, M4V, MKV, MOV, MP4, MPEG, MPG, TS, WEBM, WMV

Cada fotograma de vídeo se procesa individualmente y los resultados se devuelven por fotograma. También puedes pasar una URL de imagen pública o una imagen codificada en base64 a través del parámetro source en lugar de file.

Formato de respuesta#

Igual que en la inferencia compartida con campos específicos de la tarea.

FAQ#

¿Cuántos endpoints puedo crear?#

Los límites de los endpoints dependen del plan:

  • Free: Hasta 3 despliegues
  • Pro: Hasta 10 despliegues
  • Enterprise: Despliegues ilimitados

Cada modelo puede seguir desplegándose en múltiples regiones dentro de la cuota de tu plan.

¿Puedo cambiar la región después del despliegue?#

No, las regiones son fijas. Para cambiar de región:

  1. Elimina el endpoint existente
  2. Crea un nuevo endpoint en la región deseada

¿Cómo gestiono el despliegue en varias regiones?#

Para una cobertura global:

  1. Despliega en múltiples regiones
  2. Utiliza un balanceador de carga o enrutamiento DNS
  3. Dirige a los usuarios al endpoint más cercano

¿Cuál es el tiempo de arranque en frío?#

El tiempo de arranque en frío depende del modelo y de si el endpoint se ha escalado a cero. La solicitud de comprobación de estado de Platform permite hasta 55 segundos para que un endpoint inactivo tenga tiempo de iniciarse.

Cada despliegue utiliza actualmente la URL de endpoint generada que se muestra en su tarjeta de despliegue.

Comentarios