Monitorización#
Ultralytics Platform proporciona monitorización para endpoints desplegados. Haz el seguimiento de las métricas de peticiones, visualiza registros y comprueba el estado de salud con sondeo automático.

Panel de despliegues#
La página Deploy en la barra lateral sirve como panel de control de monitorización para todos tus despliegues. Combina el mapa mundial, métricas generales y la gestión de despliegues en una única vista. Consulta Dedicated Endpoints para crear y gestionar despliegues.
graph TB
subgraph Dashboard
Map[World Map]:::proc --- Cards[Overview Cards]:::proc
Cards --- List[Deployments List]:::decide
end
subgraph "Per Deployment"
Metrics[Metrics Row]:::out
Health[Health Check]:::out
Logs[Logs Tab]:::out
Code[Code Tab]:::out
Predict[Predict Tab]:::out
end
List --> Metrics
List --> Health
List --> Logs
List --> Code
List --> Predict
classDef proc fill:#2196F3,color:#fff
classDef decide fill:#FF9800,color:#fff
classDef out fill:#9C27B0,color:#fffTarjetas de resumen#
Cuatro tarjetas de resumen en la parte superior de la página muestran:

| Métrica | Descripción |
|---|---|
| Solicitudes totales (24h) | Solicitudes a través de todos los endpoints |
| Despliegues activos | Endpoints actualmente en ejecución |
| Tasa de error (24h) | Porcentaje de solicitudes fallidas |
| Latencia P95 (24h) | Tiempo de respuesta en el percentil 95 |
La tarjeta de tasa de error se resalta en rojo cuando la tasa supera el 5%. Comprueba la pestaña Logs en los despliegues individuales para diagnosticar errores.
Mapa mundial#
El mapa mundial interactivo muestra:
- Marcadores de región para las 42 regiones disponibles
- Marcadores verdes para las regiones desplegadas
- Marcadores azules animados para regiones con despliegues activos en progreso
- El tamaño del marcador varía según el estado del despliegue y la latencia

Lista de despliegues#
Debajo de las tarjetas de resumen, la lista de despliegues muestra todos los endpoints de tus proyectos. Utiliza el selector de modo de vista para cambiar entre:
| Vista | Descripción |
|---|---|
| Tarjetas | Tarjetas detalladas con pestañas de métricas, registros, código y predicción |
| Compacto | Cuadrícula de tarjetas pequeñas (1-4 columnas) con métricas clave |
| Tabla | DataTable con columnas ordenables: Nombre, Región, Estado, Solicitudes, P95, Errores |
El panel de control consulta el estado del despliegue cada 15 segundos. Cuando los despliegues se encuentran en un estado de transición (creating, deploying o stopping), la frecuencia de consulta aumenta a cada 3 segundos. Las métricas por despliegue se actualizan cada 60 segundos. Haz clic en el botón de actualización para obtener cambios de inmediato.
Métricas por despliegue#
Cada tarjeta de despliegue (en la vista de tarjetas) muestra métricas en tiempo real:
Fila de métricas#
| Métrica | Descripción |
|---|---|
| Solicitudes | Número de solicitudes (24h) con icono |
| Latencia P95 | Tiempo de respuesta en el percentil 95 |
| Tasa de error | Porcentaje de solicitudes fallidas |
Las métricas se obtienen del endpoint de la API de sparkline y se actualizan cada 60 segundos.
Comprobación de estado#
Los despliegues en ejecución muestran un indicador de comprobación de estado:
| Indicador | Significado |
|---|---|
| Corazón verde | Saludable: muestra la latencia de respuesta |
| Corazón rojo | No saludable: muestra el mensaje de error |
| Icono giratorio | Comprobación de estado en progreso |
Las comprobaciones de estado se reintentan automáticamente cada 20 segundos cuando no son saludables. Haz clic en el icono de refrescar para activar manualmente una comprobación de estado. La comprobación utiliza un tiempo de espera de 55 segundos para adaptarse a arranques en frío en endpoints con escalado a cero.

La solicitud de comprobación de estado permite hasta 55 segundos para que un punto de enlace con escalado a cero tenga tiempo de iniciarse.
Registros#
Cada tarjeta de despliegue incluye una pestaña Logs para ver las entradas de registro recientes:

Entradas de registro#
Cada entrada de registro muestra:
| Campo | Descripción |
|---|---|
| Severidad | Barra codificada por colores (ver abajo) |
| Marca de tiempo | Hora de solicitud (formato local) |
| Mensaje | Contenido del registro |
| Información HTTP | Código de estado y latencia (si procede) |
Filtra los registros por severidad usando los botones de filtro:
| Nivel | Color | Descripción |
|---|---|---|
| DEBUG | Gris | Mensajes de depuración |
| INFO | Azul | Solicitudes normales |
| WARNING | Amarillo | Problemas no críticos |
| ERROR | Rojo | Solicitudes fallidas |
| CRITICAL | Rojo oscuro | Fallos críticos |
La interfaz muestra las 20 entradas más recientes. La API tiene un límite por defecto de 50 entradas por solicitud (máximo 200).
Al investigar errores: haz clic primero en Errores para filtrar las entradas ERROR y WARNING, luego revisa las marcas de tiempo y los códigos de estado HTTP. Copia los registros al portapapeles para compartirlos con tu equipo.
Ejemplos de código#
Cada tarjeta de despliegue incluye una pestaña Code que muestra código de API listo para usar con tu URL de endpoint real y clave de API:
import requests
# Deployment endpoint
url = "https://predict-abc123.run.app/predict"
# Headers with your deployment API key
headers = {"Authorization": "Bearer YOUR_API_KEY"}
# Inference parameters
data = {"conf": 0.25, "iou": 0.7, "imgsz": 640}
# Send image for inference
with open("image.jpg", "rb") as f:
response = requests.post(url, headers=headers, data=data, files={"file": f})
print(response.json())Al visualizar la pestaña Code en la plataforma, tu URL de endpoint real y tu clave de API se rellenan automáticamente. Copia el código y ejecútalo directamente. Consulta API Keys para generar una clave.
Inferencia de despliegue#
La pestaña Predict en cada tarjeta de implementación proporciona un panel de predicción integrado: la misma interfaz que la pestaña Predict del modelo, pero ejecutando la inferencia a través del endpoint de implementación en lugar del servicio compartido. Esto es útil para probar un endpoint implementado directamente desde el navegador. Consulta Inference para ver los detalles de los parámetros y los formatos de respuesta.
Endpoints de la API#
Descripción general de la monitorización#
GET /api/monitoringDevuelve métricas agregadas para todas las implementaciones propiedad del usuario autenticado. Reconoce el espacio de trabajo mediante el parámetro de consulta opcional owner.
Métricas de implementación#
GET /api/deployments/{deploymentId}/metrics?sparkline=true&range=24hDevuelve datos de minigráficos (sparkline) y métricas de resumen para una implementación específica. Intervalo de actualización: 60 segundos.
| Parámetro | Tipo | Descripción |
|---|---|---|
sparkline | bool | Incluir datos de minigráficos |
range | cadena | Intervalo de tiempo: 1h, 6h, 24h, 7d o 30d |
Registros de implementación#
GET /api/deployments/{deploymentId}/logs?limit=50&severity=ERROR,WARNINGDevuelve entradas de registro recientes con filtro de gravedad y paginación opcionales.
| Parámetro | Tipo | Descripción |
|---|---|---|
limit | entero | Máximo de entradas a devolver (predeterminado: 50, máximo: 200) |
severity | cadena | Filtro de gravedad separado por comas |
pageToken | cadena | Token de paginación de la respuesta anterior |
Estado de la implementación#
GET /api/deployments/{deploymentId}/healthDevuelve el estado de la comprobación de salud junto con la latencia de respuesta.
{
"healthy": true,
"status": 200,
"latencyMs": 142,
"serverTiming": { "db": 8, "ping": 142, "total": 150 }
}Optimización del rendimiento#
Usa los datos de monitorización para optimizar tus implementaciones:
Si la latencia es demasiado alta:
- Verifica que el tamaño del modelo sea el adecuado
- Considera una región más cercana
- Comprueba el tamaño de imagen enviado con cada solicitud
Prueba con un valor de imgsz más pequeño y compara la latencia y la precisión resultantes para tu modelo. Despliega en una región más cercana a los usuarios para reducir la latencia de red.
FAQ#
¿Cuánto tiempo se retienen los datos?#
La API de métricas admite ventanas seleccionables desde 1 hora hasta 30 días. La tarjeta de despliegue muestra las 20 entradas de registro más recientes; la API de registros puede devolver hasta 200 entradas por solicitud y admite paginación.
¿Puedo monitorizar varios endpoints juntos?#
Sí, la página de implementaciones muestra todos los endpoints con tarjetas de resumen agregadas. Utiliza la vista de tabla para comparar el rendimiento entre implementaciones.