YOLO Vision 2026:

모니터링#

Ultralytics Platform배포된 엔드포인트를 위한 모니터링 기능을 제공합니다. 자동 폴링을 통해 요청 메트릭을 추적하고, 로그를 확인하며, 상태 정보를 점검하십시오.

Ultralytics Platform Deploy Page Overview Cards And World Map

배포 대시보드#

사이드바의 Deploy 페이지는 모든 배포를 위한 모니터링 대시보드 역할을 합니다. 이 페이지는 세계 지도, 개요 메트릭, 배포 관리를 하나의 화면에 통합하여 보여줍니다. 배포 생성 및 관리에 대한 내용은 Dedicated Endpoints를 참조하십시오.

graph TB
    subgraph Dashboard
        Map[World Map]:::proc --- Cards[Overview Cards]:::proc
        Cards --- List[Deployments List]:::decide
    end
    subgraph "Per Deployment"
        Metrics[Metrics Row]:::out
        Health[Health Check]:::out
        Logs[Logs Tab]:::out
        Code[Code Tab]:::out
        Predict[Predict Tab]:::out
    end
    List --> Metrics
    List --> Health
    List --> Logs
    List --> Code
    List --> Predict

    classDef proc fill:#2196F3,color:#fff
    classDef decide fill:#FF9800,color:#fff
    classDef out fill:#9C27B0,color:#fff

개요 카드#

페이지 상단에 있는 4개의 요약 카드는 다음 정보를 표시합니다:

Ultralytics Platform Deploy Page Four Overview Cards

지표설명
총 요청 수(24시간)모든 엔드포인트에 걸친 요청 수
활성 배포현재 실행 중인 엔드포인트
오류율(24시간)실패한 요청의 비율
P95 지연 시간(24시간)95번째 백분위수 응답 시간
오류율 알림

오류율이 5%를 초과하면 오류율 카드가 빨간색으로 강조 표시됩니다. 개별 배포의 Logs 탭을 확인하여 오류를 진단하십시오.

세계 지도#

대화형 세계 지도는 다음 정보를 보여줍니다:

  • 사용 가능한 모든 42개 리전에 대한 Region pins
  • 녹색 핀: 배포된 지역
  • 애니메이션 파란색 핀: 배포가 진행 중인 활성 지역
  • 핀 크기: 배포 상태 및 지연 시간에 따라 다름

Ultralytics Platform Deploy Page World Map With Deployed Regions

배포 목록#

개요 카드 아래의 배포 목록에는 프로젝트 전반의 모든 엔드포인트가 표시됩니다. 보기 모드 토글을 사용하여 다음 모드로 전환할 수 있습니다:

보기설명
카드메트릭, 로그, 코드 및 예측 탭이 포함된 전체 상세 카드
컴팩트주요 메트릭이 포함된 작은 카드 그리드(1~4열)
테이블정렬 가능한 열이 있는 데이터 테이블: 이름, 지역, 상태, 요청 수, P95, 오류
실시간 업데이트

대시보드는 배포 상태 업데이트를 위해 15초마다 폴링을 수행합니다. 배포가 전환 상태(creating, deploying, stopping)인 경우 폴링 주기가 3초로 단축됩니다. 배포별 메트릭은 60초마다 새로 고쳐집니다. 즉시 업데이트하려면 새로 고침 버튼을 클릭하십시오.

배포별 메트릭#

각 배포 카드(카드 보기 모드)는 실시간 메트릭을 보여줍니다:

메트릭 행#

지표설명
요청 수아이콘과 함께 표시되는 요청 횟수(24시간)
P95 지연 시간95번째 백분위수 응답 시간
오류율실패한 요청의 비율

메트릭은 스파크라인 API 엔드포인트에서 가져오며 60초마다 새로 고쳐집니다.

상태 확인#

실행 중인 배포에는 상태 점검 표시기가 나타납니다:

표시기의미
녹색 하트정상 — 응답 지연 시간 표시
빨간색 하트비정상 — 오류 메시지 표시
회전하는 아이콘상태 점검 진행 중

상태 점검은 비정상 상태일 때 20초마다 자동 재시도됩니다. 새로 고침 아이콘을 클릭하여 수동으로 상태 점검을 트리거할 수 있습니다. 상태 점검은 scale-to-zero 엔드포인트의 콜드 스타트를 수용하기 위해 55초의 제한 시간을 사용합니다.

Ultralytics Platform Deployment Card Health Check Healthy With Latency

콜드 스타트 허용 오차

상태 확인 요청은 scale-to-zero 엔드포인트가 시작될 시간을 확보할 수 있도록 최대 55초까지 허용됩니다.

로그#

각 배포 카드에는 최근 로그 항목을 볼 수 있는 Logs 탭이 포함되어 있습니다:

Ultralytics Platform Deployment Card Logs Tab With Severity Filter

로그 항목#

각 로그 항목은 다음을 보여줍니다:

필드설명
심각도색상 코딩된 막대(아래 참조)
타임스탬프요청 시간(현지 형식)
메시지로그 콘텐츠
HTTP 정보상태 코드 및 지연 시간(해당하는 경우)

필터 버튼을 사용하여 심각도별로 로그를 필터링하십시오:

수준색상설명
DEBUG회색디버그 메시지
INFO파란색일반 요청
WARNING노란색중요하지 않은 문제
ERROR빨간색실패한 요청
CRITICAL짙은 빨간색치명적인 오류

UI에는 최근 항목 20개가 표시됩니다. API는 요청당 기본적으로 50개 항목을 제공하며 최대 200개까지 가능합니다.

디버깅 워크플로우

오류를 조사할 때: 먼저 Errors를 클릭하여 ERROR 및 WARNING 항목으로 필터링한 다음 타임스탬프와 HTTP 상태 코드를 검토하십시오. 로그를 클립보드에 복사하여 팀과 공유할 수 있습니다.

코드 예제#

각 배포 카드에는 실제 엔드포인트 URL 및 API 키가 포함된 즉시 사용 가능한 API 코드를 보여주는 Code 탭이 있습니다:

import requests

# Deployment endpoint
url = "https://predict-abc123.run.app/predict"

# Headers with your deployment API key
headers = {"Authorization": "Bearer YOUR_API_KEY"}

# Inference parameters
data = {"conf": 0.25, "iou": 0.7, "imgsz": 640}

# Send image for inference
with open("image.jpg", "rb") as f:
    response = requests.post(url, headers=headers, data=data, files={"file": f})

print(response.json())
자동 채워진 자격 증명

플랫폼에서 Code 탭을 볼 때, 실제 엔드포인트 URL과 API 키가 자동으로 채워집니다. 코드를 복사하여 즉시 실행하십시오. 키 생성 방법은 API Keys를 참조하십시오.

배포 모델 예측#

각 배포 카드에 있는 Predict 탭은 인라인 예측 패널을 제공합니다. 이는 모델의 Predict 탭과 동일한 인터페이스이지만, 공유 서비스 대신 배포 엔드포인트를 통해 추론을 실행합니다. 이는 브라우저에서 직접 배포된 엔드포인트를 테스트할 때 유용합니다. 매개변수 세부 정보 및 응답 형식은 Inference를 참조하십시오.

API 엔드포인트#

모니터링 개요#

GET /api/monitoring

인증된 사용자가 소유한 모든 배포에 대한 집계된 메트릭을 반환합니다. 선택적 owner 쿼리 매개변수를 통해 워크스페이스를 인식합니다.

배포 메트릭#

GET /api/deployments/{deploymentId}/metrics?sparkline=true&range=24h

특정 배포에 대한 스파크라인 데이터 및 요약 메트릭을 반환합니다. 새로 고침 간격: 60초.

파라미터유형설명
sparklinebool스파크라인 데이터 포함
range문자열(string)시간 범위: 1h, 6h, 24h, 7d 또는 30d

배포 로그#

GET /api/deployments/{deploymentId}/logs?limit=50&severity=ERROR,WARNING

선택적 심각도 필터 및 페이지네이션을 포함하여 최근 로그 항목을 반환합니다.

파라미터유형설명
limit정수(int)반환할 최대 항목 수 (기본값: 50, 최대값: 200)
severity문자열(string)쉼표로 구분된 심각도 필터
pageToken문자열(string)이전 응답에서 가져온 페이지네이션 토큰

배포 상태#

GET /api/deployments/{deploymentId}/health

응답 지연 시간과 함께 상태 확인 결과를 반환합니다.

{
    "healthy": true,
    "status": 200,
    "latencyMs": 142,
    "serverTiming": { "db": 8, "ping": 142, "total": 150 }
}

성능 최적화#

모니터링 데이터를 사용하여 배포를 최적화하십시오:

지연 시간이 너무 높을 경우:

  1. 모델 크기가 적절한지 확인하십시오
  2. 더 가까운 리전 고려
  3. 각 요청과 함께 전송되는 이미지 크기를 확인하십시오
지연 시간 감소

더 작은 imgsz 값을 시도하고 모델의 결과 지연 시간과 정확도를 비교해 보십시오. 네트워크 지연 시간을 줄이기 위해 호출자와 더 가까운 리전에 배포하십시오.

FAQ#

데이터는 얼마나 오래 보관됩니까?#

메트릭 API는 1시간부터 30일까지 선택 가능한 윈도우를 지원합니다. 배포 카드는 가장 최근 로그 항목 20개를 표시하며, 로그 API는 요청당 최대 200개의 항목을 반환할 수 있고 페이지네이션을 지원합니다.

여러 엔드포인트를 함께 모니터링할 수 있습니까?#

네, 배포 페이지에는 모든 엔드포인트가 집계된 개요 카드로 표시됩니다. 테이블 뷰를 사용하여 배포 간 성능을 비교하십시오.

댓글