YOLO Vision 2026:

Monitorización#

Ultralytics Platform proporciona monitorización para endpoints desplegados. Haz el seguimiento de las métricas de peticiones, visualiza registros y comprueba el estado de salud con sondeo automático.

Ultralytics Platform Deploy Page Overview Cards And World Map

Panel de despliegues#

La página Deploy en la barra lateral sirve como panel de control de monitorización para todos tus despliegues. Combina el mapa mundial, métricas generales y la gestión de despliegues en una única vista. Consulta Dedicated Endpoints para crear y gestionar despliegues.

graph TB
    subgraph Dashboard
        Map[World Map]:::proc --- Cards[Overview Cards]:::proc
        Cards --- List[Deployments List]:::decide
    end
    subgraph "Per Deployment"
        Metrics[Metrics Row]:::out
        Health[Health Check]:::out
        Logs[Logs Tab]:::out
        Code[Code Tab]:::out
        Predict[Predict Tab]:::out
    end
    List --> Metrics
    List --> Health
    List --> Logs
    List --> Code
    List --> Predict

    classDef proc fill:#2196F3,color:#fff
    classDef decide fill:#FF9800,color:#fff
    classDef out fill:#9C27B0,color:#fff

Tarjetas de resumen#

Cuatro tarjetas de resumen en la parte superior de la página muestran:

Ultralytics Platform Deploy Page Four Overview Cards

MétricaDescripción
Solicitudes totales (24h)Solicitudes a través de todos los endpoints
Despliegues activosEndpoints actualmente en ejecución
Tasa de error (24h)Porcentaje de solicitudes fallidas
Latencia P95 (24h)Tiempo de respuesta en el percentil 95
Alerta de tasa de error

La tarjeta de tasa de error se resalta en rojo cuando la tasa supera el 5%. Comprueba la pestaña Logs en los despliegues individuales para diagnosticar errores.

Mapa mundial#

El mapa mundial interactivo muestra:

  • Marcadores de región para las 42 regiones disponibles
  • Marcadores verdes para las regiones desplegadas
  • Marcadores azules animados para regiones con despliegues activos en progreso
  • El tamaño del marcador varía según el estado del despliegue y la latencia

Ultralytics Platform Deploy Page World Map With Deployed Regions

Lista de despliegues#

Debajo de las tarjetas de resumen, la lista de despliegues muestra todos los endpoints de tus proyectos. Utiliza el selector de modo de vista para cambiar entre:

VistaDescripción
TarjetasTarjetas detalladas con pestañas de métricas, registros, código y predicción
CompactoCuadrícula de tarjetas pequeñas (1-4 columnas) con métricas clave
TablaDataTable con columnas ordenables: Nombre, Región, Estado, Solicitudes, P95, Errores
Actualizaciones en tiempo real

El panel de control consulta el estado del despliegue cada 15 segundos. Cuando los despliegues se encuentran en un estado de transición (creating, deploying o stopping), la frecuencia de consulta aumenta a cada 3 segundos. Las métricas por despliegue se actualizan cada 60 segundos. Haz clic en el botón de actualización para obtener cambios de inmediato.

Métricas por despliegue#

Cada tarjeta de despliegue (en la vista de tarjetas) muestra métricas en tiempo real:

Fila de métricas#

MétricaDescripción
SolicitudesNúmero de solicitudes (24h) con icono
Latencia P95Tiempo de respuesta en el percentil 95
Tasa de errorPorcentaje de solicitudes fallidas

Las métricas se obtienen del endpoint de la API de sparkline y se actualizan cada 60 segundos.

Comprobación de estado#

Los despliegues en ejecución muestran un indicador de comprobación de estado:

IndicadorSignificado
Corazón verdeSaludable: muestra la latencia de respuesta
Corazón rojoNo saludable: muestra el mensaje de error
Icono giratorioComprobación de estado en progreso

Las comprobaciones de estado se reintentan automáticamente cada 20 segundos cuando no son saludables. Haz clic en el icono de refrescar para activar manualmente una comprobación de estado. La comprobación utiliza un tiempo de espera de 55 segundos para adaptarse a arranques en frío en endpoints con escalado a cero.

Ultralytics Platform Deployment Card Health Check Healthy With Latency

Tolerancia al arranque en frío

La solicitud de comprobación de estado permite hasta 55 segundos para que un punto de enlace con escalado a cero tenga tiempo de iniciarse.

Registros#

Cada tarjeta de despliegue incluye una pestaña Logs para ver las entradas de registro recientes:

Ultralytics Platform Deployment Card Logs Tab With Severity Filter

Entradas de registro#

Cada entrada de registro muestra:

CampoDescripción
SeveridadBarra codificada por colores (ver abajo)
Marca de tiempoHora de solicitud (formato local)
MensajeContenido del registro
Información HTTPCódigo de estado y latencia (si procede)

Filtra los registros por severidad usando los botones de filtro:

NivelColorDescripción
DEBUGGrisMensajes de depuración
INFOAzulSolicitudes normales
WARNINGAmarilloProblemas no críticos
ERRORRojoSolicitudes fallidas
CRITICALRojo oscuroFallos críticos

La interfaz muestra las 20 entradas más recientes. La API tiene un límite por defecto de 50 entradas por solicitud (máximo 200).

Flujo de trabajo de depuración

Al investigar errores: haz clic primero en Errores para filtrar las entradas ERROR y WARNING, luego revisa las marcas de tiempo y los códigos de estado HTTP. Copia los registros al portapapeles para compartirlos con tu equipo.

Ejemplos de código#

Cada tarjeta de despliegue incluye una pestaña Code que muestra código de API listo para usar con tu URL de endpoint real y clave de API:

import requests

# Deployment endpoint
url = "https://predict-abc123.run.app/predict"

# Headers with your deployment API key
headers = {"Authorization": "Bearer YOUR_API_KEY"}

# Inference parameters
data = {"conf": 0.25, "iou": 0.7, "imgsz": 640}

# Send image for inference
with open("image.jpg", "rb") as f:
    response = requests.post(url, headers=headers, data=data, files={"file": f})

print(response.json())
Credenciales autocompletadas

Al visualizar la pestaña Code en la plataforma, tu URL de endpoint real y tu clave de API se rellenan automáticamente. Copia el código y ejecútalo directamente. Consulta API Keys para generar una clave.

Inferencia de despliegue#

La pestaña Predict en cada tarjeta de implementación proporciona un panel de predicción integrado: la misma interfaz que la pestaña Predict del modelo, pero ejecutando la inferencia a través del endpoint de implementación en lugar del servicio compartido. Esto es útil para probar un endpoint implementado directamente desde el navegador. Consulta Inference para ver los detalles de los parámetros y los formatos de respuesta.

Endpoints de la API#

Descripción general de la monitorización#

GET /api/monitoring

Devuelve métricas agregadas para todas las implementaciones propiedad del usuario autenticado. Reconoce el espacio de trabajo mediante el parámetro de consulta opcional owner.

Métricas de implementación#

GET /api/deployments/{deploymentId}/metrics?sparkline=true&range=24h

Devuelve datos de minigráficos (sparkline) y métricas de resumen para una implementación específica. Intervalo de actualización: 60 segundos.

ParámetroTipoDescripción
sparklineboolIncluir datos de minigráficos
rangecadenaIntervalo de tiempo: 1h, 6h, 24h, 7d o 30d

Registros de implementación#

GET /api/deployments/{deploymentId}/logs?limit=50&severity=ERROR,WARNING

Devuelve entradas de registro recientes con filtro de gravedad y paginación opcionales.

ParámetroTipoDescripción
limitenteroMáximo de entradas a devolver (predeterminado: 50, máximo: 200)
severitycadenaFiltro de gravedad separado por comas
pageTokencadenaToken de paginación de la respuesta anterior

Estado de la implementación#

GET /api/deployments/{deploymentId}/health

Devuelve el estado de la comprobación de salud junto con la latencia de respuesta.

{
    "healthy": true,
    "status": 200,
    "latencyMs": 142,
    "serverTiming": { "db": 8, "ping": 142, "total": 150 }
}

Optimización del rendimiento#

Usa los datos de monitorización para optimizar tus implementaciones:

Si la latencia es demasiado alta:

  1. Verifica que el tamaño del modelo sea el adecuado
  2. Considera una región más cercana
  3. Comprueba el tamaño de imagen enviado con cada solicitud
Reducción de la latencia

Prueba con un valor de imgsz más pequeño y compara la latencia y la precisión resultantes para tu modelo. Despliega en una región más cercana a los usuarios para reducir la latencia de red.

FAQ#

¿Cuánto tiempo se retienen los datos?#

La API de métricas admite ventanas seleccionables desde 1 hora hasta 30 días. La tarjeta de despliegue muestra las 20 entradas de registro más recientes; la API de registros puede devolver hasta 200 entradas por solicitud y admite paginación.

¿Puedo monitorizar varios endpoints juntos?#

Sí, la página de implementaciones muestra todos los endpoints con tarjetas de resumen agregadas. Utiliza la vista de tabla para comparar el rendimiento entre implementaciones.

Comentarios