YOLO Vision 2026:

모니터링#

Ultralytics Platform배포된 엔드포인트 모니터링을 제공합니다. 자동 폴링을 통해 요청 메트릭을 추적하고, 로그를 확인하며, 상태를 점검할 수 있습니다.

Ultralytics Platform Deploy Page Overview Cards And World Map

배포 대시보드#

사이드바의 Deploy 페이지는 모든 배포를 위한 모니터링 대시보드 역할을 합니다. 이 페이지는 세계 지도, 개요 메트릭, 배포 관리를 하나의 뷰로 통합합니다. 배포 생성 및 관리에 대해서는 전용 엔드포인트를 참조하십시오.

graph TB
    subgraph Dashboard
        Map[World Map]:::proc --- Cards[Overview Cards]:::proc
        Cards --- List[Deployments List]:::decide
    end
    subgraph "Per Ready Deployment"
        Metrics[Metrics Row]:::out
        Health[Health Check]:::out
        Logs[Logs Tab]:::out
        Code[Code Tab]:::out
        Predict[Predict Tab]:::out
    end
    List --> Metrics
    List --> Health
    List --> Logs
    List --> Code
    List --> Predict

    classDef proc fill:#2196F3,color:#fff
    classDef decide fill:#FF9800,color:#fff
    classDef out fill:#9C27B0,color:#fff

개요 카드#

페이지 상단에 있는 4개의 요약 카드는 다음 정보를 표시합니다:

Ultralytics Platform Deploy Page Four Overview Cards

지표설명
총 요청 수(24시간)모든 엔드포인트에 걸친 요청 수
활성 배포현재 Ready 상태인 엔드포인트
오류율(24시간)요청 볼륨으로 가중치를 부여한 4xx 또는 5xx 상태 코드 응답의 비율
P95 지연 시간(24시간)볼륨으로 가중치를 부여한 시간당 95번째 백분위수 지연 시간의 평균

헬스 체크가 몇 밀리초 만에 응답하므로 그렇지 않으면 실제 추론 지연 시간의 전체적인 모습을 압도하게 되므로, 중앙값 대신 P95 지연 시간이 보고됩니다.

오류율 알림

오류율이 5%를 초과하면 오류율 카드가 빨간색으로 강조 표시됩니다. 오류를 진단하려면 개별 배포에서 Logs 탭을 확인하십시오.

세계 지도#

대화형 세계 지도는 다음 정보를 보여줍니다:

  • 사용 가능한 모든 42개 리전에 대한 Region pins
  • 준비된 배포가 있는 지역에 대한 초록색 핀
  • 애니메이션 파란색 핀: 배포가 진행 중인 활성 지역
  • 핀 크기: 배포 상태 및 지연 시간에 따라 다름

New Deployment 대화상자를 열려면 아무 지역이나 클릭하세요. 지도는 작은 화면에서 숨겨집니다.

Ultralytics Platform Deploy Page World Map With Deployed Regions

배포 목록#

개요 카드 아래의 배포 목록에는 프로젝트 전반의 모든 엔드포인트가 표시됩니다. 보기 모드 토글을 사용하여 다음 모드로 전환할 수 있습니다:

보기설명
카드메트릭, 로그, 코드 및 예측 탭이 포함된 전체 상세 카드
컴팩트주요 메트릭이 포함된 작은 카드 그리드(1~4열)
테이블정렬 가능한 열이 있는 데이터 테이블: 이름, 지역, 상태, 요청 수, P95, 오류
실시간 업데이트

대시보드는 자동으로 새로 고쳐지며, 배포가 전환 상태(creating, deploying, 또는 stopping)에 있는 동안 더 빠르게 업데이트됩니다. 즉시 업데이트하려면 새로 고침 버튼을 클릭하세요.

배포별 메트릭#

각 배포 카드(카드 뷰)에는 실시간 메트릭이 표시됩니다. 아래에 설명된 메트릭 행, 상태 확인, 그리고 Logs, Code, Predict 탭은 배포가 Ready 상태인 동안에만 나타납니다.

메트릭 행#

지표설명
요청 수지난 24시간 동안의 요청 수
P95 지연 시간시간당 95번째 백분위수 지연 시간의 평균 (24h)
오류율0 초과일 때만 표시되는 4xx 및 5xx 응답의 비율

메트릭은 자동으로 새로 고쳐집니다. 요청을 처리한 적이 없는 엔드포인트는 "No traffic yet"으로 표시되며, 메트릭은 Ready 상태인 배포에 대해서만 수집됩니다. 배포 대시보드에서는 가장 최근의 배포 20개에 대한 메트릭을 가져옵니다.

상태 확인#

실행 중인 배포에는 상태 점검 표시기가 나타납니다:

표시기의미
녹색 하트정상 — 응답 지연 시간 표시
빨간색 하트비정상 — 오류 메시지 표시
회전하는 아이콘상태 점검 진행 중

헬스 체크는 비정상 상태일 때 자동으로 재시도하며 엔드포인트가 응답하면 중지됩니다. 새로 고침 아이콘을 클릭하여 헬스 체크를 수동으로 트리거할 수 있으며, 이는 트래픽을 보내기 전에 규모가 0으로 축소된 엔드포인트를 예열하는 방법으로도 사용됩니다.

Ultralytics Platform Deployment Card Health Check Healthy With Latency

콜드 스타트 허용 오차

플랫폼은 헬스 체크에 추가 시간을 부여하고 일시적인 연결 실패를 재시도하므로 규모가 0으로 축소된 엔드포인트가 시작될 시간이 있습니다. 카드에 "Service starting up..."이 표시되면 새로 고쳐서 그 사이에 부팅을 완료한 인스턴스를 가져오세요.

로그#

각 배포 카드에는 최근 로그 항목을 확인하기 위한 Logs 탭이 포함되어 있습니다:

Ultralytics Platform Deployment Card Logs Tab With Severity Filter

로그 항목#

각 로그 항목은 다음을 보여줍니다:

필드설명
심각도색상 코딩된 막대(아래 참조)
타임스탬프요청 시간(현지 형식)
메시지로그 콘텐츠
HTTP 정보상태 코드 및 지연 시간(해당하는 경우)

각 항목에는 색상으로 구분된 심각도 막대가 포함되어 있습니다:

수준색상설명
DEBUG회색디버그 메시지
INFO파란색일반 요청
WARNING호박색중요하지 않은 문제
ERROR빨간색실패한 요청
CRITICAL빨간색치명적인 오류

API는 쉼표로 구분된 필터로 전체 로그 심각도 세트를 허용합니다: DEBUG, INFO, NOTICE, WARNING, ERROR, CRITICAL, ALERT, 및 EMERGENCY.

UI는 가장 최근 항목 20개를 표시하고 빈 항목은 숨깁니다. API는 요청당 기본적으로 50개 항목(최대 200개)을 제공하며 더 이전 페이지로 이동하기 위한 nextPageToken을 반환합니다.

디버깅 워크플로우

오류를 조사할 때: 먼저 Errors를 클릭하여 ERROR 및 WARNING 항목으로 필터링한 다음 타임스탬프와 HTTP 상태 코드를 검토하십시오. 로그를 클립보드에 복사하여 팀과 공유할 수 있습니다.

코드 예제#

각 배포 카드에는 엔드포인트 URL이 채워진 즉시 사용 가능한 API 코드를 보여주는 Code 탭이 포함되어 있습니다. 워크스페이스 소유자의 경우 배포에 바인딩된 API 키가 삽입되어 바로 복사하여 실행할 수 있습니다. 소유자가 아닌 경우 YOUR_API_KEY 자리 표시자가 표시됩니다:

import requests

# Deployment endpoint
url = "https://YOUR_DEPLOYMENT_URL.run.app/predict"

# Headers with your deployment API key
headers = {"Authorization": "Bearer YOUR_API_KEY"}

# Inference parameters
data = {"conf": 0.25, "iou": 0.7, "imgsz": 640}

# Send image for inference
with open("image.jpg", "rb") as f:
    response = requests.post(url, headers=headers, data=data, files={"file": f})

print(response.json())
자동 채워진 자격 증명

플랫폼에서 Code 탭을 볼 때 엔드포인트 URL과 워크스페이스 소유자의 경우 배포의 바인딩된 API 키가 자동으로 채워집니다. 키를 생성하려면 API Keys를 참조하세요.

배포 모델 예측#

각 배포 카드의 Predict 탭은 인라인 예측 패널을 제공합니다. 이는 모델의 Predict 탭과 동일한 인터페이스이지만, 공유 서비스 대신 배포 엔드포인트를 통해 추론을 실행합니다. 이는 브라우저에서 직접 배포된 엔드포인트를 테스트하는 데 유용합니다. 매개변수 세부 정보 및 응답 형식은 추론을 참조하십시오.

API 엔드포인트#

모든 배포는 소유자와 배포 이름으로 주소가 지정되며 각 라우트에는 API 키가 필요합니다. 인증 세부 정보는 API reference를 참조하세요.

배포 메트릭#

GET /api/deployments/{owner}/{deployment}/metrics?range=24h

Python SDK: client.deployments.metrics(owner, deployment, range="24h")

배포에 대한 전체 메트릭 페이로드를 반환합니다: 총 요청수, 오류 수 및 비율, 평균, P50, P95, P99 지연 시간이 포함된 summary 블록과 요청, 오류, P50 및 P95 지연 시간, CPU 및 메모리 사용량, 인스턴스 수에 대한 timeSeries 배열.

파라미터유형설명
range문자열(string)시간 범위: 1h, 6h, 24h, 7d, 또는 30d (기본값 24h)
sparklinebool전체 페이로드 대신 간소화된 대시보드 요약 반환

sparkline=true을 사용하면 응답은 배포 카드가 사용하는 간소화된 형식(24시간별 요청 수와 총 요청 수, 오류율, 평균 지연 시간)이 됩니다. 이것이 60초마다 새로 고쳐지는 호출입니다.

배포 로그#

GET /api/deployments/{owner}/{deployment}/logs?limit=50&severity=ERROR,WARNING

Python SDK: client.deployments.logs(owner, deployment, limit=50, severity="ERROR,WARNING")

선택적 심각도 필터 및 페이지네이션을 포함하여 최근 로그 항목을 반환합니다.

파라미터유형설명
limit정수(int)반환할 최대 항목 수 (기본값: 50, 최대값: 200)
severity문자열(string)쉼표로 구분된 심각도 필터
pageToken문자열(string)이전 응답에서 가져온 페이지네이션 토큰

배포 상태#

GET /api/deployments/{owner}/{deployment}/health

Python SDK: client.deployments.health(owner, deployment)

배포를 핑하고 측정된 왕복 지연 시간과 함께 헬스 상태를 반환합니다:

{
    "healthy": true,
    "status": 200,
    "latencyMs": 142
}

비정상 응답은 엔드포인트에 전혀 도달할 수 없을 때 status을 생략하고 error 메시지를 추가합니다.

대시보드 개요

Deploy 페이지의 집계된 숫자는 단일 REST 엔드포인트로 제공되지 않습니다. GET /api/deployments/{owner} (client.deployments.list(owner))이 반환하는 각 배포에 대한 메트릭 라우트를 호출하여 이를 재현하십시오.

성능 최적화#

모니터링 데이터를 사용하여 배포를 최적화하십시오:

지연 시간이 너무 높을 경우:

  1. 모델 크기가 적절한지 확인하십시오
  2. 더 가까운 리전 고려
  3. 각 요청과 함께 전송되는 이미지 크기를 확인하십시오
지연 시간 감소

더 작은 imgsz 값을 시도하고 모델의 결과 지연 시간과 정확도를 비교하십시오. 네트워크 지연 시간을 줄이려면 호출자에 더 가까운 리전에 배포하십시오.

FAQ#

  • 메트릭 API는 1시간에서 30일까지 선택 가능한 윈도우를 지원하며, 윈도우가 커짐에 따라 더 거칠게 샘플링됩니다(1시간 동안은 1분 버킷, 30일 동안은 최대 4시간 버킷). 배포 카드는 가장 최근의 로그 항목 20개를 보여주며, 로그 API는 요청당 최대 200개의 항목을 반환할 수 있고 페이지네이션을 지원합니다.

    메트릭과 로그는 배포가 존재하는 동안에만 유지되므로 배포를 삭제하면 해당 기록에 대한 액세스도 종료됩니다. 엔드포인트를 삭제하기 전에 보관해야 할 내용은 내보내세요.

  • 네, 배포 페이지에는 모든 엔드포인트가 집계된 개요 카드로 표시됩니다. 테이블 뷰를 사용하여 배포 간 성능을 비교하십시오.

  • 아니요. 메트릭과 헬스 체크는 Ready 상태인 배포에 대해서만 수집됩니다. 중지된 엔드포인트는 카드와 기록 윈도우를 유지하지만 다시 시작할 때까지 라이브 숫자를 표시하지 않습니다.

댓글