Monitorización#
Ultralytics Platform proporciona monitorización para los endpoints desplegados. Rastrea las métricas de peticiones, visualiza los registros y comprueba el estado de salud con sondeo automático.

Panel de despliegues#
La página Deploy en la barra lateral sirve como panel de control de monitorización para todos tus despliegues. Combina el mapamundi, las métricas generales y la gestión de despliegues en una sola vista. Consulta Dedicated Endpoints para crear y gestionar despliegues.
graph TB
subgraph Dashboard
Map[World Map]:::proc --- Cards[Overview Cards]:::proc
Cards --- List[Deployments List]:::decide
end
subgraph "Per Deployment"
Metrics[Metrics Row]:::out
Health[Health Check]:::out
Logs[Logs Tab]:::out
Code[Code Tab]:::out
Predict[Predict Tab]:::out
end
List --> Metrics
List --> Health
List --> Logs
List --> Code
List --> Predict
classDef proc fill:#2196F3,color:#fff
classDef decide fill:#FF9800,color:#fff
classDef out fill:#9C27B0,color:#fffTarjetas de resumen#
Cuatro tarjetas de resumen en la parte superior de la página muestran:

| Métrica | Descripción |
|---|---|
| Solicitudes totales (24h) | Solicitudes a través de todos los endpoints |
| Despliegues activos | Endpoints actualmente en el estado Ready |
| Tasa de error (24h) | Proporción de respuestas con un estado 4xx o 5xx, ponderada por volumen de solicitudes |
| Latencia P95 (24h) | Promedio de las latencias del percentil 95 por hora, ponderado por volumen |
Se informa el percentil P95 en lugar de la mediana de la latencia porque las comprobaciones de estado se completan en un par de milisegundos y, de lo contrario, dominarían la perspectiva de la latencia de inferencia real.
La tarjeta de tasa de errores se destaca en rojo cuando la tasa supera el 5%. Comprueba la pestaña Logs en los despliegues individuales para diagnosticar errores.
Mapa mundial#
El mapa mundial interactivo muestra:
- Marcadores de región para las 42 regiones disponibles
- Pines verdes para regiones con un despliegue listo
- Marcadores azules animados para regiones con despliegues activos en progreso
- El tamaño del marcador varía según el estado del despliegue y la latencia
Haz clic en cualquier región para abrir el diálogo New Deployment. El mapa se oculta en pantallas pequeñas.

Lista de despliegues#
Debajo de las tarjetas de resumen, la lista de despliegues muestra todos los endpoints de tus proyectos. Utiliza el selector de modo de vista para cambiar entre:
| Vista | Descripción |
|---|---|
| Tarjetas | Tarjetas detalladas con pestañas de métricas, registros, código y predicción |
| Compacto | Cuadrícula de tarjetas pequeñas (1-4 columnas) con métricas clave |
| Tabla | DataTable con columnas ordenables: Nombre, Región, Estado, Solicitudes, P95, Errores |
El panel se actualiza automáticamente, haciéndolo con mayor frecuencia mientras los despliegues se encuentran en un estado de transición (creating, deploying o stopping). Haz clic en el botón de actualizar para obtener actualizaciones inmediatas.
Métricas por despliegue#
Cada tarjeta de despliegue (en la vista de tarjetas) muestra métricas en tiempo real:
Fila de métricas#
| Métrica | Descripción |
|---|---|
| Solicitudes | Recuento de solicitudes durante las últimas 24 horas |
| Latencia P95 | Promedio de las latencias del percentil 95 por hora (24h) |
| Tasa de error | Proporción de respuestas 4xx y 5xx, mostrada únicamente cuando es superior a 0 |
Las métricas se actualizan automáticamente. Los endpoints que no han atendido ninguna solicitud muestran "Sin tráfico aún", y las métricas se recopilan únicamente para despliegues en el estado Ready. En el panel de despliegues, se obtienen las métricas de los 20 despliegues más recientes.
Comprobación de estado#
Los despliegues en ejecución muestran un indicador de comprobación de estado:
| Indicador | Significado |
|---|---|
| Corazón verde | Saludable: muestra la latencia de respuesta |
| Corazón rojo | No saludable: muestra el mensaje de error |
| Icono giratorio | Comprobación de estado en progreso |
Las comprobaciones de estado se reintentan automáticamente mientras no sean saludables y se detienen una vez que el endpoint responde. Haz clic en el icono de actualizar para activar manualmente una comprobación de estado, que también sirve como método para calentar un endpoint escalado a cero antes de enviar tráfico.

La plataforma otorga tiempo adicional a la comprobación de estado y reintenta los fallos de conexión transitorios, de modo que un endpoint escalado a cero disponga del tiempo necesario para iniciar. Si la tarjeta indica "Iniciando servicio...", actualízala para captar una instancia que haya terminado de arrancar mientras tanto.
Registros#
Cada tarjeta de despliegue incluye una pestaña Logs para ver las entradas de registro recientes:

Entradas de registro#
Cada entrada de registro muestra:
| Campo | Descripción |
|---|---|
| Severidad | Barra codificada por colores (ver abajo) |
| Marca de tiempo | Hora de solicitud (formato local) |
| Mensaje | Contenido del registro |
| Información HTTP | Código de estado y latencia (si procede) |
Cada entrada incluye una barra de gravedad codificada por colores:
| Nivel | Color | Descripción |
|---|---|---|
| DEBUG | Gris | Mensajes de depuración |
| INFO | Azul | Solicitudes normales |
| WARNING | Ámbar | Problemas no críticos |
| ERROR | Rojo | Solicitudes fallidas |
| CRITICAL | Rojo | Fallos críticos |
La API acepta el conjunto completo de gravedades de registro como un filtro separado por comas: DEBUG, INFO, NOTICE, WARNING, ERROR, CRITICAL, ALERT y EMERGENCY.
La interfaz muestra las 20 entradas más recientes y oculta las que están vacías. La API utiliza por defecto 50 entradas por solicitud (máximo 200) y devuelve un nextPageToken para la paginación hacia atrás.
Al investigar errores: haz clic primero en Errores para filtrar las entradas ERROR y WARNING, luego revisa las marcas de tiempo y los códigos de estado HTTP. Copia los registros al portapapeles para compartirlos con tu equipo.
Ejemplos de código#
Cada tarjeta de despliegue incluye una pestaña Code que muestra código de API listo para usar con la URL del endpoint ya integrada. Para los propietarios del espacio de trabajo, se inserta la clave de API vinculada al despliegue, lista para copiar y ejecutar. Los usuarios que no sean propietarios verán un marcador de posición YOUR_API_KEY:
import requests
# Deployment endpoint
url = "https://YOUR_DEPLOYMENT_URL.run.app/predict"
# Headers with your deployment API key
headers = {"Authorization": "Bearer YOUR_API_KEY"}
# Inference parameters
data = {"conf": 0.25, "iou": 0.7, "imgsz": 640}
# Send image for inference
with open("image.jpg", "rb") as f:
response = requests.post(url, headers=headers, data=data, files={"file": f})
print(response.json())Al visualizar la pestaña Code en la plataforma, la URL del endpoint y, para los propietarios del espacio de trabajo, la clave de API vinculada del despliegue se rellenan automáticamente. Consulta API Keys para generar una clave.
Inferencia de despliegue#
La pestaña Predict en cada tarjeta de despliegue proporciona un panel de predicción integrado (la misma interfaz que la pestaña Predict del modelo, pero ejecutando la inferencia a través del endpoint de despliegue en lugar del servicio compartido). Esto es útil para probar un endpoint desplegado directamente desde el navegador. Consulta Inference para obtener detalles de los parámetros y formatos de respuesta.
Endpoints de la API#
Cada despliegue se identifica mediante su propietario y nombre de despliegue, y cada ruta requiere una clave de API. Consulta la referencia de la API para obtener detalles de autenticación.
Métricas de implementación#
GET /api/deployments/{owner}/{deployment}/metrics?range=24hDevuelve la carga útil completa de métricas de un despliegue: un bloque summary con el total de solicitudes, el recuento y la tasa de errores, y la latencia promedio, P50, P95 y P99, además de las matrices timeSeries para solicitudes, errores, latencia P50 y P95, utilización de CPU y memoria, y recuento de instancias.
| Parámetro | Tipo | Descripción |
|---|---|---|
range | cadena | Rango de tiempo: 1h, 6h, 24h, 7d o 30d (por defecto 24h) |
sparkline | bool | Devuelve el resumen compacto del panel en lugar de la carga útil completa |
Con sparkline=true, la respuesta adopta el formato compacto que utilizan las tarjetas de despliegue: 24 recuentos de solicitudes por hora, junto con el total de solicitudes, la tasa de errores y la latencia promedio. Esta es la llamada que se actualiza cada 60 segundos.
Registros de implementación#
GET /api/deployments/{owner}/{deployment}/logs?limit=50&severity=ERROR,WARNINGDevuelve entradas de registro recientes con filtro de gravedad y paginación opcionales.
| Parámetro | Tipo | Descripción |
|---|---|---|
limit | entero | Máximo de entradas a devolver (predeterminado: 50, máximo: 200) |
severity | cadena | Filtro de gravedad separado por comas |
pageToken | cadena | Token de paginación de la respuesta anterior |
Estado de la implementación#
GET /api/deployments/{owner}/{deployment}/healthRealiza un ping al despliegue y devuelve su estado de salud junto con la latencia de ida y vuelta medida:
{
"healthy": true,
"status": 200,
"latencyMs": 142
}Una respuesta no saludable omite status cuando no se ha podido contactar con el endpoint en absoluto, y añade un mensaje error.
Los números agregados en la página Deploy no están disponibles como un único endpoint REST. Reprodúcelos llamando a la ruta de métricas para cada despliegue devuelto por GET /api/deployments/{owner}.
Optimización del rendimiento#
Usa los datos de monitorización para optimizar tus implementaciones:
Si la latencia es demasiado alta:
- Verifica que el tamaño del modelo sea el adecuado
- Considera una región más cercana
- Comprueba el tamaño de imagen enviado con cada solicitud
Prueba con un valor de imgsz menor y compara la latencia y precisión resultantes para tu modelo. Despliega en una región más cercana a los usuarios para reducir la latencia de red.
FAQ#
La API de métricas admite ventanas seleccionables desde 1 hora hasta 30 días, las cuales se muestrean de forma menos precisa a medida que la ventana aumenta — desde intervalos de 1 minuto para 1 hora hasta intervalos de 4 horas para 30 días. La tarjeta de despliegue muestra las 20 entradas de registro más recientes; la API de registros puede devolver hasta 200 entradas por solicitud y admite paginación.
Las métricas y los registros se conservan únicamente mientras exista el despliegue, por lo que eliminar un despliegue también finaliza el acceso a su historial. Exporta todo lo que necesites conservar antes de eliminar un endpoint.
Sí, la página de implementaciones muestra todos los endpoints con tarjetas de resumen agregadas. Utiliza la vista de tabla para comparar el rendimiento entre implementaciones.
No. Las métricas y las comprobaciones de estado se recopilan exclusivamente para despliegues en el estado Ready. Un endpoint detenido conserva su tarjeta y su ventana de historial, pero no muestra datos en vivo hasta que vuelvas a iniciarlo.