YOLO Vision 2026:

Giám sát#

Ultralytics Platform cung cấp khả năng giám sát cho các endpoint đã triển khai. Theo dõi các metric yêu cầu, xem nhật ký và kiểm tra trạng thái sức khỏe với cơ chế polling tự động.

Ultralytics Platform Deploy Page Overview Cards And World Map

Bảng điều khiển triển khai#

Trang Deploy trong thanh bên đóng vai trò là bảng điều khiển giám sát cho tất cả các bản triển khai của bạn. Nó kết hợp bản đồ thế giới, các metric tổng quan và quản lý triển khai trong một giao diện duy nhất. Xem phần Dedicated Endpoints để tạo và quản lý các bản triển khai.

graph TB
    subgraph Dashboard
        Map[World Map]:::proc --- Cards[Overview Cards]:::proc
        Cards --- List[Deployments List]:::decide
    end
    subgraph "Per Ready Deployment"
        Metrics[Metrics Row]:::out
        Health[Health Check]:::out
        Logs[Logs Tab]:::out
        Code[Code Tab]:::out
        Predict[Predict Tab]:::out
    end
    List --> Metrics
    List --> Health
    List --> Logs
    List --> Code
    List --> Predict

    classDef proc fill:#2196F3,color:#fff
    classDef decide fill:#FF9800,color:#fff
    classDef out fill:#9C27B0,color:#fff

Thẻ tổng quan#

Bốn thẻ tóm tắt ở đầu trang hiển thị:

Ultralytics Platform Deploy Page Four Overview Cards

Chỉ sốMô tả
Tổng số yêu cầu (24h)Số lượng yêu cầu trên tất cả các endpoint
Triển khai đang hoạt độngCác endpoint hiện đang ở trạng thái Ready
Tỷ lệ lỗi (24h)Tỷ lệ phản hồi có mã trạng thái 4xx hoặc 5xx, được tính trọng số theo lưu lượng request
Độ trễ P95 (24h)Trung bình của độ trễ phân vị thứ 95 theo giờ, được tính trọng số theo lưu lượng

Độ trễ P95 thay vì độ trễ trung bình (median) được báo cáo vì các kiểm tra sức khỏe phản hồi trong vài mili-giây và nếu không sẽ làm lu mờ bức tranh tổng thể về độ trễ inference thực tế.

Cảnh báo tỷ lệ lỗi

Thẻ tỷ lệ lỗi sẽ chuyển sang màu đỏ khi tỷ lệ vượt quá 5%. Kiểm tra tab Logs trên từng bản triển khai để chẩn đoán lỗi.

Bản đồ thế giới#

Bản đồ tương tác thế giới hiển thị:

  • Ghim vùng (Region pins) cho tất cả 42 vùng khả dụng
  • Ghim màu xanh lá cho các vùng có deployment sẵn sàng
  • Ghim xanh dương động cho các vùng đang có triển khai thực thi
  • Kích thước ghim thay đổi dựa trên trạng thái triển khai và độ trễ

Nhấp vào bất kỳ vùng nào để mở hộp thoại New Deployment. Bản đồ được ẩn trên các màn hình nhỏ.

Ultralytics Platform Deploy Page World Map With Deployed Regions

Danh sách triển khai#

Bên dưới các thẻ tổng quan, danh sách triển khai hiển thị tất cả các endpoint trong các dự án của bạn. Sử dụng nút chuyển chế độ xem để thay đổi giữa:

XemMô tả
CardsThẻ chi tiết đầy đủ với các tab số liệu, nhật ký, mã nguồn và dự đoán
CompactLưới các thẻ nhỏ (1-4 cột) với các số liệu chính
TableDataTable với các cột có thể sắp xếp: Tên, Vùng, Trạng thái, Yêu cầu, P95, Lỗi
Cập nhật thời gian thực

Bảng điều khiển tự động làm mới, cập nhật nhanh hơn khi các deployment đang ở trạng thái chuyển tiếp (creating, deploying hoặc stopping). Nhấp vào nút làm mới để cập nhật ngay lập tức.

Số liệu theo từng bản triển khai#

Mỗi thẻ deployment (ở chế độ xem thẻ) hiển thị các số liệu thời gian thực. Hàng số liệu, quá trình kiểm tra tình trạng hệ thống và các tab Logs, Code, và Predict được mô tả bên dưới chỉ xuất hiện khi deployment ở trạng thái Ready:

Hàng số liệu#

Chỉ sốMô tả
Yêu cầuSố lượng request trong 24 giờ qua
Độ trễ P95Trung bình độ trễ phân vị thứ 95 theo giờ (24h)
Tỷ lệ lỗiTỷ lệ phản hồi 4xx và 5xx, chỉ hiển thị khi lớn hơn 0

Metrics tự động làm mới. Các endpoint chưa phục vụ request nào hiển thị "No traffic yet", và metrics chỉ được thu thập cho các deployment ở trạng thái Ready. Trên bảng điều khiển deployments, metrics được lấy cho 20 deployment gần nhất.

Kiểm tra tình trạng#

Các bản triển khai đang chạy hiển thị chỉ báo kiểm tra sức khỏe:

Chỉ báoÝ nghĩa
Trái tim màu xanh láKhỏe mạnh — hiển thị độ trễ phản hồi
Trái tim màu đỏKhông khỏe mạnh — hiển thị thông báo lỗi
Biểu tượng xoay vòngĐang thực hiện kiểm tra sức khỏe

Các kiểm tra sức khỏe sẽ tự động thử lại khi trạng thái không khỏe và dừng lại ngay khi endpoint phản hồi. Nhấp vào biểu tượng làm mới để kích hoạt thủ công việc kiểm tra sức khỏe, đồng thời đóng vai trò là cách để làm ấm endpoint bị thu nhỏ về 0 (scaled-to-zero) trước khi gửi lưu lượng.

Ultralytics Platform Deployment Card Health Check Healthy With Latency

Khả năng chịu đựng khởi động lạnh

Platform cung cấp thêm thời gian cho việc kiểm tra sức khỏe và thử lại các lỗi kết nối tạm thời, nhờ đó endpoint thu nhỏ về 0 có thời gian khởi động. Nếu thẻ báo "Service starting up...", hãy làm mới lại để nhận instance vừa hoàn tất quá trình khởi động trong thời gian đó.

Nhật ký#

Mỗi thẻ triển khai bao gồm một tab Logs để xem các mục nhật ký gần đây:

Ultralytics Platform Deployment Card Logs Tab With Severity Filter

Mục nhật ký#

Mỗi mục nhật ký hiển thị:

Trường (Field)Mô tả
Mức độ nghiêm trọngThanh mã màu (xem bên dưới)
Dấu thời gianThời gian yêu cầu (định dạng địa phương)
Thông điệpNội dung nhật ký
Thông tin HTTPMã trạng thái và độ trễ (nếu có)

Mỗi mục đều có thanh mức độ nghiêm trọng được mã hóa bằng màu sắc:

Mức độMàu sắcMô tả
DEBUGXámCác thông điệp gỡ lỗi
INFOXanh dươngCác yêu cầu bình thường
WARNINGVàng hổ pháchCác vấn đề không nghiêm trọng
ERRORĐỏCác yêu cầu thất bại
CRITICALĐỏCác lỗi nghiêm trọng

API chấp nhận tập hợp đầy đủ các mức độ nghiêm trọng của log dưới dạng bộ lọc ngăn cách bằng dấu phẩy: DEBUG, INFO, NOTICE, WARNING, ERROR, CRITICAL, ALERTEMERGENCY.

Giao diện người dùng hiển thị 20 mục gần nhất và ẩn các mục trống. API mặc định là 50 mục cho mỗi request (tối đa 200) và trả về một nextPageToken để phân trang lùi xa hơn.

Quy trình gỡ lỗi

Khi điều tra lỗi: trước tiên hãy nhấp vào Errors để lọc các mục ERROR và WARNING, sau đó xem xét dấu thời gian và mã trạng thái HTTP. Sao chép nhật ký vào bảng tạm để chia sẻ với nhóm của bạn.

Ví dụ mã nguồn#

Mỗi thẻ deployment bao gồm tab Code hiển thị mã API sẵn sàng sử dụng với URL endpoint đã được điền sẵn. Đối với chủ sở hữu workspace, khóa API được liên kết của deployment sẽ được chèn vào, sẵn sàng để sao chép và chạy. Người dùng không phải chủ sở hữu sẽ thấy trình giữ chỗ YOUR_API_KEY:

import requests

# Deployment endpoint
url = "https://YOUR_DEPLOYMENT_URL.run.app/predict"

# Headers with your deployment API key
headers = {"Authorization": "Bearer YOUR_API_KEY"}

# Inference parameters
data = {"conf": 0.25, "iou": 0.7, "imgsz": 640}

# Send image for inference
with open("image.jpg", "rb") as f:
    response = requests.post(url, headers=headers, data=data, files={"file": f})

print(response.json())
Thông tin xác thực tự động điền

Khi xem tab Code trong nền tảng, URL endpoint và, đối với chủ sở hữu workspace, khóa API liên kết của deployment sẽ được điền sẵn cho bạn. Xem phần API Keys để tạo khóa.

Suy luận triển khai#

Tab Predict trên mỗi thẻ triển khai cung cấp một bảng điều khiển dự đoán nội tuyến — giao diện tương tự như tab Predict của model, nhưng chạy suy luận thông qua endpoint triển khai thay vì dịch vụ chia sẻ. Điều này hữu ích để kiểm tra trực tiếp một endpoint đã triển khai từ trình duyệt. Xem phần Inference để biết chi tiết về tham số và định dạng phản hồi.

Các API Endpoints#

Mỗi deployment được định địa chỉ bởi chủ sở hữu và tên deployment của nó, và mỗi tuyến đường (route) đều yêu cầu một khóa API. Xem phần Tài liệu tham khảo API để biết chi tiết về xác thực.

Số liệu triển khai#

GET /api/deployments/{owner}/{deployment}/metrics?range=24h

Python SDK: client.deployments.metrics(owner, deployment, range="24h")

Trả về toàn bộ payload metrics cho một deployment: một khối summary với tổng số request, số lượng và tỷ lệ lỗi, cùng với độ trễ trung bình, P50, P95 và P99, cộng thêm các mảng timeSeries cho request, lỗi, độ trễ P50 và P95, mức sử dụng CPU và bộ nhớ, cùng số lượng instance.

Tham sốLoạiMô tả
rangestringKhoảng thời gian: 1h, 6h, 24h, 7d hoặc 30d (mặc định là 24h)
sparklineboolTrả về bản tóm tắt bảng điều khiển gọn nhẹ thay vì toàn bộ payload

Với sparkline=true, phản hồi sẽ ở dạng gọn nhẹ mà các thẻ deployment sử dụng — 24 số lượng request theo giờ cộng với tổng số request, tỷ lệ lỗi và độ trễ trung bình. Đây là lệnh gọi làm mới cứ sau 60 giây.

Nhật ký triển khai#

GET /api/deployments/{owner}/{deployment}/logs?limit=50&severity=ERROR,WARNING

Python SDK: client.deployments.logs(owner, deployment, limit=50, severity="ERROR,WARNING")

Trả về các mục nhật ký gần đây với bộ lọc mức độ nghiêm trọng tùy chọn và phân trang.

Tham sốLoạiMô tả
limitintSố mục tối đa được trả về (mặc định: 50, tối đa: 200)
severitystringBộ lọc mức độ nghiêm trọng phân tách bằng dấu phẩy
pageTokenstringToken phân trang từ phản hồi trước đó

Tình trạng triển khai#

GET /api/deployments/{owner}/{deployment}/health

Python SDK: client.deployments.health(owner, deployment)

Gửi ping đến deployment và trả về trạng thái sức khỏe kèm theo độ trễ khứ hồi được đo đạc:

{
    "healthy": true,
    "status": 200,
    "latencyMs": 142
}

Một phản hồi không khỏe sẽ bỏ qua status khi không thể kết nối tới endpoint, và thêm một thông báo error.

Tổng quan bảng điều khiển

Các số liệu được tổng hợp trên trang Deploy không khả dụng dưới dạng một endpoint REST duy nhất. Hãy tái tạo chúng bằng cách gọi route số liệu cho từng deployment được trả về bởi GET /api/deployments/{owner} (client.deployments.list(owner)).

Tối ưu hóa hiệu suất#

Sử dụng dữ liệu giám sát để tối ưu hóa các triển khai của bạn:

Nếu độ trễ quá cao:

  1. Xác minh kích thước model là phù hợp
  2. Cân nhắc một khu vực gần hơn
  3. Kiểm tra kích thước ảnh được gửi kèm theo mỗi request
Giảm độ trễ

Hãy thử một giá trị imgsz nhỏ hơn và so sánh độ trễ cũng như độ chính xác thu được cho model của bạn. Triển khai đến một khu vực gần người gọi hơn để giảm độ trễ mạng.

Câu hỏi thường gặp#

  • API metrics hỗ trợ các khoảng thời gian có thể chọn từ 1 giờ đến 30 ngày, được lấy mẫu thô hơn khi khoảng thời gian càng lớn — các bucket 1 phút trong 1 giờ cho đến các bucket 4 giờ trong 30 ngày. Thẻ deployment hiển thị 20 mục log gần nhất; API log có thể trả về tối đa 200 mục cho mỗi request và hỗ trợ phân trang.

    Metrics và log chỉ được lưu giữ chừng nào deployment còn tồn tại, do đó việc xóa deployment cũng làm chấm dứt quyền truy cập vào lịch sử của nó. Hãy xuất bất cứ thứ gì bạn cần giữ lại trước khi xóa một endpoint.

  • Có, trang triển khai hiển thị tất cả các endpoint với các thẻ tổng quan đã được gộp lại. Sử dụng chế độ xem bảng để so sánh hiệu suất giữa các triển khai.

  • Không. Metrics và kiểm tra sức khỏe chỉ được thu thập cho các deployment ở trạng thái Ready. Một endpoint đã dừng vẫn giữ nguyên thẻ và khoảng thời gian lịch sử của nó nhưng không hiển thị số liệu trực tiếp cho đến khi bạn khởi động lại.

Bình luận