Ultralytics YOLO27:
Get Started

Endpoint chuyên dụng#

Ultralytics Platform cho phép triển khai model YOLO lên các endpoint chuyên dụng tại 42 khu vực trên toàn cầu. Mỗi endpoint là một dịch vụ dành riêng cho một tenant, có URL endpoint riêng và cơ chế giám sát độc lập. Tài nguyên mặc định sẽ thu nhỏ về 0 khi không hoạt động; các kích thước tùy chỉnh duy trì một phiên bản luôn sẵn sàng và được tính phí theo thời gian hoạt động.

Tab triển khai model của Ultralytics Platform với bản đồ khu vực và bảng

Tạo endpoint#

Từ tab Deploy#

Triển khai model từ tab Deploy của model đó:

  1. Điều hướng đến model của bạn
  2. Nhấp vào tab Deploy
  3. Xem bản đồ thế giới và bảng khu vực, được sắp xếp theo độ trễ đo được từ vị trí của bạn
  4. Nhấp vào Deploy trong hàng khu vực bạn muốn sử dụng
  5. Trong hộp thoại, xem lại CPU, bộ nhớ, giá và tên triển khai, sau đó nhấp vào Create Deployment

Tên được đề xuất ghép tên model với thành phố của khu vực (ví dụ: yolo26n-iowa) và có thể chỉnh sửa trước khi triển khai. Model phải có weights; nếu không, tab sẽ hiển thị trạng thái trống thay vì bảng khu vực.

Từ tab Deployments#

Tạo một bản triển khai từ tab Deployments trên hồ sơ của bạn hoặc từ thanh bên:

  1. Nhấp vào New Deployment trong tab Deployments, hoặc nhấp vào + bên cạnh Deployments trong thanh bên
  2. Chọn một model từ bộ chọn model, nơi liệt kê các model đã hoàn tất của bạn
  3. Chọn một khu vực từ bản đồ thu nhỏ hoặc bảng độ trễ
  4. Chọn CPU và bộ nhớ, xem lại giá, rồi chỉnh sửa tên triển khai được đề xuất nếu cần
  5. Nhấp vào Create Deployment

Hộp thoại tạo triển khai mới của Ultralytics Platform với bộ chọn model và bản đồ khu vực

Vòng đời triển khai#

stateDiagram-v2
    [*] --> Creating: Deploy
    Creating --> Deploying: Service starting
    Deploying --> Ready: Service URL published
    Ready --> Stopping: Stop
    Ready --> Deploying: Replace model or resize
    Stopping --> Stopped: Stopped
    Stopped --> Deploying: Start
    Deploying --> Stopped: Start failed
    Ready --> [*]: Delete
    Stopped --> [*]: Delete
    Creating --> Failed: Error
    Deploying --> Failed: Error
    Failed --> [*]: Delete

    classDef proc fill:#2196F3,color:#fff
    classDef out fill:#9C27B0,color:#fff
    classDef error fill:#F44336,color:#fff
    classDef extern fill:#607D8B,color:#fff
    class Creating,Deploying,Stopping proc
    class Ready out
    class Failed error
    class Stopped extern

Kết nối cảnh báo Slack để nhận thông báo khi một bản triển khai sẵn sàng hoặc không khởi động được.

Chọn vùng#

Chọn trong số 42 khu vực trên toàn thế giới. Bản đồ khu vực tương tác và bảng hiển thị:

  • Các ghim khu vực: Được mã hóa màu theo độ trễ trên dải màu từ xanh lá đến đỏ (khu vực nhanh hơn có màu xanh hơn, khu vực chậm hơn có màu đỏ hơn)
  • Các khu vực đã triển khai: Được đánh dấu bằng nhãn "Deployed" trong bảng
  • Các khu vực đang triển khai: Ghim và hàng trong bảng có chỉ báo nhấp nháy động
  • Đánh dấu hai chiều: Di chuột lên bản đồ sẽ làm nổi bật hàng tương ứng trong bảng và ngược lại

Bảng độ trễ khu vực trong tab Deploy của Ultralytics Platform, được sắp xếp theo độ trễ

Bảng khu vực trong tab Deploy của model bao gồm:

CộtMô tả
Vị tríThành phố và quốc gia cùng biểu tượng lá cờ
ZoneMã định danh khu vực
Độ trễThời gian ping đo được từ trình duyệt của bạn
Khoảng cáchKhoảng cách tính bằng km từ vị trí ước tính của bạn
Thao tácNút Deploy hoặc nhãn trạng thái "Deployed"

Có thể tìm kiếm trong bảng theo thành phố, quốc gia và zone; theo mặc định, bảng được sắp xếp theo độ trễ.

Hộp thoại tạo triển khai mới

Hộp thoại New Deployment (từ tab Deployments hoặc thanh bên) hiển thị một bảng khu vực đơn giản hơn, chỉ có các cột Vị trí, Độ trễ và Chọn; bảng liệt kê 20 khu vực nhanh nhất cùng ghi chú về các khu vực còn lại. Sử dụng bản đồ thu nhỏ để chọn bất kỳ khu vực nào khác.

Cách đo độ trễ

Trình duyệt của bạn đo độ trễ đến từng khu vực trong số 42 khu vực; kết quả được lưu vào bộ nhớ đệm trong 30 phút và dùng chung giữa tab Deploy và hộp thoại New Deployment. Sử dụng nút Rescan trong tab Deploy của model để đo lại từ mạng hiện tại của bạn. Khoảng cách được tính từ vị trí ước tính của request, vì vậy đây chỉ là thông tin tham khảo, không phải giá trị chính xác.

Các khu vực khả dụng#

ZoneVị trí
us-central1Iowa, Hoa Kỳ
us-east1Nam Carolina, Hoa Kỳ
us-east4Bắc Virginia, Hoa Kỳ
us-east5Columbus, Hoa Kỳ
us-south1Dallas, Hoa Kỳ
us-west1Oregon, Hoa Kỳ
us-west2Los Angeles, Hoa Kỳ
us-west3Salt Lake City, Hoa Kỳ
us-west4Las Vegas, Hoa Kỳ
northamerica-northeast1Montreal, Canada
northamerica-northeast2Toronto, Canada
northamerica-south1Queretaro, Mexico
southamerica-east1Sao Paulo, Brazil
southamerica-west1Santiago, Chile

Cấu hình endpoint#

Hộp thoại triển khai mới#

Hộp thoại New Deployment cho phép bạn chọn model, khu vực, tài nguyên và tên triển khai:

TrườngMô tả
ModelBất kỳ model nào đã hoàn tất trong workspace, được chọn bằng bộ chọn
Khu vựcKhu vực triển khai, được chọn trên bản đồ thu nhỏ hoặc trong bảng độ trễ
CPU và bộ nhớChọn kích thước tài nguyên và xem lại mức giá được hiển thị
Tên triển khaiTên được tự động tạo sau khi thiết lập model và khu vực, và có thể chỉnh sửa

Hộp thoại triển khai mới trên Ultralytics Platform với tài nguyên mặc định cố định

Chọn kích thước CPU và bộ nhớ trong phần điều khiển tài nguyên, đồng thời xem lại mức giá được hiển thị trước khi tạo triển khai. Các tùy chọn CPU là 1, 2, 4, 6 hoặc 8 vCPU; các tùy chọn bộ nhớ từ 2 đến 32 GiB. Kích thước bộ nhớ lớn hơn cần nhiều vCPU hơn (ví dụ: 16 GiB cần tối thiểu 4 vCPU), và hộp thoại sẽ giải thích mọi tổ hợp không hợp lệ. Kích thước mặc định (1 vCPU, 2 GiB) miễn phí và tự động giảm về 0 khi không hoạt động. Kích thước tùy chỉnh duy trì một instance luôn sẵn sàng và được tính phí theo mức giá theo giờ tại khu vực hiển thị, kể từ khi sẵn sàng cho đến khi bạn dừng endpoint, bao gồm cả thời gian không hoạt động. Để tạo, khởi động hoặc đổi kích thước sang cấu hình tùy chỉnh, cần có credit khả dụng; các endpoint dùng kích thước tùy chỉnh sẽ tự động dừng khi workspace hết credit. Agents sử dụng lại hộp thoại này khi bạn chọn Triển khai mới….

Hộp thoại triển khai mới trên Ultralytics Platform với giá CPU và bộ nhớ tùy chỉnh

Tên được tạo tự động

Tên triển khai kết hợp tên model với thành phố của khu vực, ví dụ yolo26n-iowa. Tên phải là duy nhất trong một workspace: nếu tên đã được sử dụng, hộp thoại sẽ hiển thị lỗi ngay tại chỗ và vô hiệu hóa Tạo triển khai cho đến khi bạn chọn tên khác.

Tab Triển khai (Triển khai nhanh)#

Triển khai từ tab Deploy của model sẽ mở cùng hộp thoại với model và khu vực được chọn sẵn. Xem lại kích thước tài nguyên, giá và tên được tạo tự động trước khi tạo endpoint. Trong quá trình tạo, triển khai sẽ xuất hiện trong danh sách triển khai của model bên dưới bảng khu vực.

Quản lý endpoint#

Chế độ xem#

Danh sách triển khai hỗ trợ ba chế độ xem:

Chế độMô tả
ThẻThẻ hiển thị trạng thái, kích thước, chỉ số, khoảng cách và ngày triển khai
Thu gọnLưới thẻ nhỏ hơn với các chỉ số chính
BảngDataTable với các cột có thể sắp xếp

Tab Triển khai trên Ultralytics Platform với các triển khai đang hoạt động ở chế độ xem thẻ

Chế độ xem thu gọn và dạng bảng

Thẻ thu gọn hiển thị cờ, tên, thành phố, trạng thái và ba chỉ số. Có thể sắp xếp chế độ xem dạng bảng theo Tên, Khu vực, Trạng thái, CPU, Bộ nhớ, Yêu cầu HTTP, Tỷ lệ lỗi HTTP, Độ trễ HTTP P95, Khoảng cách và Ngày triển khai. Mỗi thẻ và hàng đều liên kết đến trang triển khai; các thao tác vòng đời nằm trên trang đó, còn biểu tượng thùng rác bên cạnh một triển khai trong thanh bên sẽ xóa triển khai đó.

Trang triển khai#

Mỗi triển khai có trang riêng tại /{username}/deploy/{deployment}, hiển thị:

  • Phần đầu trang: Cờ khu vực, tên hiển thị (nhấp vào tên để đổi; URL trang và đường dẫn API sẽ đổi thành slug của tên mới, còn URL endpoint không đổi), huy hiệu trạng thái, vị trí và kích thước CPU cùng bộ nhớ
  • Thao tác: Cập nhật cấu hình, Thay thế model và Dừng triển khai khi ở trạng thái Sẵn sàng; Khởi động triển khai khi ở trạng thái Đã dừng; cùng menu Thao tác khác (…) gồm Thông tin, Làm mới và Xóa triển khai
  • Chỉ số: Yêu cầu HTTP, Tỷ lệ lỗi HTTP và Độ trễ HTTP P95 trong 24 giờ, kèm biểu đồ sparkline, cùng thẻ liên kết đến model đã triển khai
  • Các tab: Overview, Monitoring, Predict và Logs
  • Thông báo trạng thái: Lý do thất bại khi triển khai không thành công

Tab Overview hiển thị bản đồ vị trí, thẻ Endpoint với URL endpoint có thể sao chép, liên kết Tài liệu API và kiểm tra tình trạng hoạt động, cùng thẻ Thông tin triển khai có giá, khu vực, CPU và bộ nhớ. Tab Logs hiển thị các mục nhật ký gần đây với bộ lọc mức độ nghiêm trọng (Tất cả / Lỗi). Tab Predict cung cấp bảng dự đoán nội tuyến để kiểm thử trực tiếp trên triển khai; tab kết quả Tài liệu có sẵn các ví dụ mã trong Python, JavaScript và cURL, được điền sẵn URL endpoint và, đối với chủ sở hữu workspace, API key được liên kết (xem Giám sát). Hộp thoại Thông tin liệt kê các thuộc tính của triển khai và cho phép bạn chỉnh sửa metadata tùy chỉnh.

Cập nhật CPU và bộ nhớ#

  1. Mở trang triển khai của một endpoint ở trạng thái Sẵn sàng.
  2. Nhấp vào Cập nhật cấu hình.
  3. Chọn CPU và Bộ nhớ, rồi xem lại chi phí theo giờ được hiển thị.
  4. Nhấp vào Cập nhật cấu hình. Cấu hình hiện tại tiếp tục phục vụ cho đến khi cấu hình mới sẵn sàng.

Cấu hình cập nhật CPU và bộ nhớ cho triển khai trên Ultralytics Platform

Tài nguyên tùy chỉnh sử dụng cơ chế tính phí theo thời gian hoạt động và giữ instance luôn sẵn sàng; nhờ đó, camera IP cũng có thể chạy liên tục mà không mất thêm phí (xem Camera chạy nền). Trở về tài nguyên mặc định sẽ khôi phục cơ chế scale-to-zero và xóa camera chạy nền.

Dữ liệu giám sát tạm thời

Biểu đồ giám sát và ảnh ví dụ là dữ liệu nhẹ được lưu trong bộ nhớ. Dừng, khởi động lại, triển khai lại, đổi kích thước hoặc thay thế model có thể xóa dữ liệu này. Khởi động lại endpoint không khôi phục lịch sử. Lưu các ví dụ hữu ích vào dataset và chờ quá trình tiếp nhận dữ liệu hoàn tất trước khi thay đổi endpoint. Chỉ số vận hành và nhật ký có khoảng thời gian lưu lịch sử riêng.

Thay thế model#

Thay thế model đứng sau một endpoint đang sẵn sàng mà không thay đổi URL của endpoint:

  1. Mở trang triển khai
  2. Nhấp vào Thay thế model
  3. Chọn một model đã hoàn tất khác trong cùng workspace
  4. Có thể chỉnh sửa tên triển khai nếu muốn
  5. Nhấp vào Thay thế model

Model hiện tại tiếp tục phục vụ trong khi model thay thế khởi động. Khi model thay thế sẵn sàng, lưu lượng sẽ chuyển sang model mới. ID triển khai, URL, khu vực và API key không thay đổi; tên hiển thị chỉ thay đổi khi bạn nhập tên mới. Nếu quá trình thay thế thất bại, model và tên trước đó vẫn hoạt động.

Quá trình thay thế cần đáp ứng tất cả các điều kiện sau; nếu không, yêu cầu sẽ bị từ chối:

  • Triển khai đang ở trạng thái Ready và không có thao tác vòng đời nào khác đang diễn ra
  • Model thay thế có weights và thuộc cùng workspace với deployment
  • Model thay thế không phải là model hiện đang được triển khai
Mỗi endpoint chỉ có một model

Thay thế sẽ gỡ model trước đó khỏi deployment. Mỗi endpoint phục vụ một model; hãy tạo deployment khác nếu bạn cần cả hai model hoạt động cùng lúc.

Trạng thái deployment#

Trạng tháiMô tả
CreatingDeployment đang được thiết lập
DeployingContainer đang khởi động
ReadyEndpoint đang hoạt động và chấp nhận request
StoppingEndpoint đang tắt
StoppedEndpoint đang tạm dừng và không khả dụng
Thất bạiDeployment thất bại (xem thông báo lỗi)

Trong deployment ở trạng thái Ready, huy hiệu trên trang hiển thị Starting cho đến khi endpoint phản hồi lần đầu với kiểm tra tình trạng, và hiển thị Not responding nếu lần kiểm tra thất bại.

URL endpoint#

Mỗi endpoint có một URL riêng, ví dụ:

https://predict-<deployment-id>-<hash>-<region>.a.run.app

Thẻ deployment Ultralytics Platform với URL endpoint và nút sao chép

Nhấp vào nút sao chép để sao chép URL. Nhấp vào Tài liệu API để mở tài liệu tham khảo API riêng của endpoint. Endpoint phục vụ các đường dẫn sau:

Đường dẫnPhương thứcMô tả
/predictPOSTChạy inference; yêu cầu API key của deployment
/healthGETKiểm tra trạng thái hoạt động, báo cáo trạng thái dịch vụ và số lượng model được lưu trong bộ nhớ đệm
/GETTóm tắt trạng thái của dịch vụ đã triển khai
/docsGETTài liệu tham khảo API tương tác được tạo cho deployment, model và region này

Quản lý vòng đời#

Điều khiển trạng thái endpoint:

graph LR
    R[Ready]:::out -->|Stop| S[Stopped]:::extern
    S -->|Start| R
    R -->|Delete| D[Deleted]:::error
    S -->|Delete| D

    classDef out fill:#9C27B0,color:#fff
    classDef error fill:#F44336,color:#fff
    classDef extern fill:#607D8B,color:#fff
Thao tácMô tả
StartKhởi động lại endpoint đã dừng
StopTạm dừng endpoint
DeleteGỡ endpoint vĩnh viễn

Dừng endpoint#

Dừng endpoint khi bạn không muốn endpoint chấp nhận request:

  1. Nhấp vào Dừng deployment trên trang deployment
  2. Trạng thái endpoint chuyển thành "Stopping", sau đó là "Stopped"

Endpoint đã dừng:

  • Không chấp nhận request và không báo cáo số liệu trực tiếp hoặc trạng thái tình trạng
  • Ngừng phát sinh phí thời gian hoạt động
  • Mất số liệu thống kê giám sát tạm thời và hình ảnh ví dụ khi instance phục vụ tắt
  • Giữ nguyên URL, region và API key được liên kết; có thể khởi động lại bất cứ lúc nào
  • Vẫn được tính vào hạn mức deployment của gói — hãy xóa endpoint để giải phóng một suất

Xóa endpoint#

Gỡ endpoint vĩnh viễn:

  1. Mở Thao tác khác (…) trên trang deployment rồi nhấp vào Xóa deployment, hoặc nhấp vào biểu tượng thùng rác cạnh deployment trong thanh bên
  2. Xác nhận bằng cách nhấp vào Xóa
Thao tác vĩnh viễn

Việc xóa diễn ra ngay lập tức và không thể hoàn tác — deployment không được chuyển vào Thùng rác. Xóa endpoint sẽ gỡ dịch vụ và giải phóng một suất trong hạn mức deployment. Bạn luôn có thể tạo endpoint mới, nhưng endpoint đó sẽ có URL mới.

Deployment cũng bị xóa khi model hoặc project bị xóa vĩnh viễn, hoặc khi model hay project trong thùng rác hết thời hạn lưu giữ.

Sử dụng endpoint#

Xác thực#

Mỗi deployment được liên kết với một API key duy nhất từ workspace sở hữu model. Đưa API key vào request:

Authorization: Bearer YOUR_API_KEY

Endpoint chỉ chấp nhận key được liên kết khi tạo, vì vậy không key nào khác có thể truy cập endpoint — kể cả key khác đang hoạt động trong cùng workspace. Để kiểm soát key được liên kết, hãy triển khai qua API đã xác thực bằng key của chủ sở hữu workspace: chính key đó sẽ được liên kết và bạn đã có key này. Các deployment được tạo theo cách khác (qua giao diện Platform hoặc lời gọi API được xác thực với tư cách thành viên nhóm) sẽ tự động liên kết với một trong các key đang hoạt động của workspace sở hữu — hãy hỏi chủ sở hữu workspace để nhận giá trị key, vì chỉ chủ sở hữu mới có thể xem giá trị key (xem API Keys). Thành viên nhóm không có key được liên kết vẫn có thể chạy inference thông qua proxy predict của Platform trên trình duyệt.

Xóa key được liên kết không khóa endpoint

Xóa hoặc vô hiệu hóa API key được liên kết không thu hồi quyền truy cập trực tiếp vào endpoint — bất kỳ ai có chuỗi key đều vẫn có thể gọi URL endpoint. Thao tác này sẽ khiến proxy predict của Platform ngừng hoạt động; proxy kiểm tra key theo thời gian thực và báo rằng key không còn khả dụng. Để thu hồi hoàn toàn quyền truy cập, hãy dừng hoặc xóa deployment; sau khi xoay vòng key, hãy tạo lại endpoint để liên kết key mới.

Request trực tiếp đến endpoint#

Gửi request production trực tiếp đến URL hiển thị trên trang deployment. Các request này không đi qua bộ giới hạn tốc độ của API Platform, nên giới hạn predict 20 request/phút không áp dụng. Endpoint vẫn có giới hạn công suất riêng:

  • Mỗi endpoint được phục vụ bởi một instance duy nhất, xử lý số lượng request đồng thời có giới hạn
  • Các request không thể được xử lý kịp thời sẽ trả về 429 cùng header Retry-After
  • Một request có thể chạy tối đa 1 giờ, cho phép hoàn tất inference video
  • Kích thước body của request được giới hạn ở 32 MB; các nội dung tải lên lớn hơn sẽ bị từ chối với 413
  • Response lớn hơn 1 KB được nén bằng gzip và các request trình duyệt cross-origin được cho phép

Ví dụ request#

import requests

# Endpoint deployment
url = "https://YOUR_DEPLOYMENT_URL.run.app/predict"

# Header chứa API key của deployment
headers = {"Authorization": "Bearer YOUR_API_KEY"}

# Tham số inference
data = {"conf": 0.25, "iou": 0.7, "imgsz": 640}

# Gửi hình ảnh để inference
with open("image.jpg", "rb") as f:
    response = requests.post(url, headers=headers, data=data, files={"file": f})

print(response.json())

Tham số yêu cầu#

Tham sốKiểuMặc địnhPhạm viMô tả
filefile--Tệp ảnh hoặc video (bắt buộc trừ khi đặt source)
conffloat0.250.01 – 1.0Ngưỡng confidence tối thiểu
ioufloat0.70.0 – 0.95Ngưỡng IoU của NMS
imgszint-32 – 1280Kích thước ảnh đầu vào tính bằng pixel; mặc định là kích thước dùng để huấn luyện model (640 nếu không có)
normalizeboolfalse-Trả về tọa độ BBox trong khoảng 0 – 1
decimalsint50 – 10Độ chính xác thập phân của các giá trị tọa độ
vid_strideint1≥ 1Dự đoán trên mỗi khung hình video thứ N; tham số này không áp dụng cho ảnh
bitsint88, 12, 16Lượng tử hóa bản đồ độ sâu, chỉ dành cho model độ sâu
sourcechuỗi--URL ảnh hoặc chuỗi base64 (thay thế cho file); tối đa 4,096 ký tự qua Platform API

Endpoint giữ lại runtime inference từ lần rollout gần nhất, vì vậy các hành vi mới hơn như giá trị mặc định của kích thước huấn luyện imgsz hoặc vid_stride ở trên sẽ có hiệu lực khi có revision mới được rollout, chẳng hạn sau khi bạn thay model hoặc thay đổi CPU hay bộ nhớ. Hãy truyền rõ ràng imgsz để cố định kích thước đầu vào.

Xem Response độ sâu để biết bits thay đổi depth map được trả về như thế nào và cách giải mã depth map.

Inference video

Endpoint chuyên dụng chấp nhận cả hình ảnh và video thông qua tham số file.

  • Định dạng hình ảnh (tối đa 32 MB mỗi request): AVIF, BMP, DNG, HEIC, HEIF, JP2, JPEG, JPG, MPO, PNG, TIF, TIFF, WEBP
  • Định dạng video (tối đa 32 MB mỗi request): ASF, AVI, GIF, M4V, MKV, MOV, MP4, MPEG, MPG, TS, WEBM, WMV

Kết quả được trả về cho từng frame video đã xử lý; model độ sâu chỉ chấp nhận hình ảnh. Bạn cũng có thể truyền URL hình ảnh công khai hoặc hình ảnh mã hóa base64 qua tham số source thay cho file. Nội dung tải lên quá lớn sẽ bị từ chối với 413.

Định dạng response#

Tương tự inference dùng chung, kèm các trường dành riêng cho từng tác vụ.

Câu hỏi thường gặp#

  • Giới hạn endpoint tùy thuộc vào gói:

    • Free: Tối đa 3 deployment
    • Pro: Tối đa 10 deployment
    • Enterprise: Không giới hạn deployment

    Mỗi model vẫn có thể được triển khai ở nhiều region trong hạn mức của gói. Hạn mức được tính cho workspace sở hữu model, vì vậy deployment model dùng chung của thành viên nhóm sẽ tiêu hao hạn mức của chủ sở hữu. Khi đạt giới hạn, hệ thống trả về lỗi yêu cầu bạn xóa deployment hiện có trước.

  • Không, region được cố định. Để đổi region:

    1. Xóa endpoint hiện có
    2. Tạo endpoint mới tại region mong muốn

    Endpoint mới sẽ có URL mới. Để chỉ thay đổi model phía sau endpoint, hãy dùng thay thế model, thao tác này giữ nguyên URL.

  • Để phục vụ người dùng trên toàn cầu:

    1. Triển khai ở nhiều region
    2. Sử dụng bộ cân bằng tải hoặc định tuyến DNS
    3. Định tuyến người dùng đến endpoint gần nhất
  • Thời gian khởi động nguội phụ thuộc vào model và việc endpoint có được scale về 0 hay không; khởi động từ trạng thái nhàn rỗi có thể mất khoảng một phút, và Platform cho endpoint nhàn rỗi thêm thời gian khởi động trước khi báo trạng thái không khỏe. Mở trang deployment hoặc chạy lại kiểm tra tình trạng sẽ làm nóng endpoint nhàn rỗi, vì vậy hãy thực hiện một trong hai thao tác trước khi lưu lượng truy cập tăng đột biến.

  • Không. Mỗi deployment phục vụ lưu lượng tại URL endpoint được tạo và hiển thị trên trang deployment; URL này luôn ổn định trong suốt vòng đời deployment — kể cả khi thay model.

Bình luận